NVIDIA、AIエージェント監視基盤

COPLUS AI NEWS|朝のAIニュース

AIエージェントには「縛り」と「一言」を

AIエージェントに仕事を任せる企業が増えるなか、「AIが勝手に動きすぎない仕組み」をどう作るかが大きなテーマになっています。本日は、NVIDIAが発表したエージェントの監視基盤と、指示文に一文足すだけでAIの作り話が大きく減ったという実験の2本を取り上げます。

① NVIDIA、AIエージェントの行動を監視し、はみ出すと隔離する安全基盤「Open Agent Safety Platform」を発表

出典:NVIDIA(公式発表)、TechCrunch / 公開日:2026年9月28日(米国時間)

米NVIDIAは9月28日、AIエージェントを試験段階から本番運用まで安全に動かすための「NVIDIA Open Agent Safety Platform」を発表しました。エージェントが動ける範囲に境界を設けるオープンソースの実行環境「OpenShell」と、エージェントの動きを外側から見張る監視の仕組み「Sentry」で構成され、同社のCPU「Vera」やデータ処理用チップ「BlueField-4」と組み合わせて使います。同社は、決められた範囲の外へ出ようとするエージェントをミリ秒単位で隔離できると説明しています。発表によると、AnthropicやMicrosoft、Salesforceなど100を超える組織が参加しており、ソフトウェアは開発者向けサイトやGitHubで提供され、構成要素によって開発段階が異なるとしています。

💡 コプラスの視点

半導体の最大手が「賢いAIでも、まず権限を絞るところから」という発想を製品にしてきたことは、AIエージェントの導入を考える企業にとって大事な合図です。自社で使うAIが、どのデータに触れ、どこまで操作できるのかを一覧にしておくことが、仕組みを選ぶ前の第一歩になります。

NVIDIAの発表を読む(英語)→

② AIに「推測しないで」と書くだけで、架空データの割合が70.7%から20.2%に 16モデルで検証

出典:Earn an Honest Dollar(実験結果の公開ページ)、GIGAZINE / 公開日:2026年9月27〜28日

Webページから情報を取り出す作業で、AIがページに書かれていない値をどれだけ作り出すかを調べた実験結果が公開されました。16種類のAIモデルに、あえて目的の値が載っていないページを読ませたところ、指示を足さない場合は存在しない項目573件のうち405件(70.7%)で架空の値が出力されました。一方、「ページにない値はnullにして、推測しないでください」という趣旨の一文を加えると、574件中116件(20.2%)まで下がり、16モデルすべてで改善が見られたと報告されています。ただし公開元は、試験用に作ったページで各モデル1回ずつ試した結果であり、実際のWebサイトや別の作業にそのまま当てはまるとは限らないとしています。

💡 コプラスの視点

請求書や名刺、Webの情報をAIで転記する業務では、「分からないところは空欄にして」と一言添えるだけで、それらしい嘘の数字が紛れ込む危険を大きく減らせる可能性があります。一方で2割はまだ残るため、金額や日付など重要な項目は人が確かめる手順を残しておくことが欠かせません。

Earn an Honest Dollarの実験結果を読む(英語)→

本日のまとめ

AIを安心して使うための手当ては、NVIDIAのような大がかりな監視の仕組みから、指示文の一文まで幅があります。大切なのは、AIに任せる範囲と、人が確かめる範囲をあらかじめ決めておくことです。

コプラスでは、ChatGPT・Claude・Gemini・Perplexityを1つの環境で安全に使える法人向けサービス「UPGEAR AI」の提供や、社内ルールづくりのご相談を承っています。お気軽にお問い合わせください。