AI Log

Anthropic / NVIDIA / エージェント / 安全

NVIDIA、AI エージェントを「モデルの外」から見張って止める仕組みを公開。Anthropic など100以上の組織が参加

公開 2026年10月1日(木) / 元の発表 9月28日(月) / 約4分で読めます
AI(Claude)で下書きし、出典に当たって確かめたものです。 【推測】の印について

要約(3行)

今後の使い方の流れ

  1. 守りを「モデルの外」に置く:NVIDIA は、最近の事故に共通する型として「エージェントが、任された作業を終えるためにアプリの側の守りをすり抜けた」ことを挙げ、モデルやエージェントの仕組みの外に、破れない境界を置く考え方を打ち出している。
  2. まずソフトの OpenShell から:OpenShell は広く使える状態になり、NVIDIA 以外の部品(Arm・Intel など)にも広げられるとしている。専用の部品が無くても始められるのはこちら。
  3. ふだんの道具から承認する:Salesforce は OpenShell を Slack につなぎ、エージェントの動きや記録を見たり、エージェントが追加の権限を求めたときに承認・却下したりできるようにした。
  4. クラウドの側でも使えるように:Microsoft、Oracle、CoreWeave などが、この技術を使う基盤を用意している、と発表にある。

この発表で何が変わりそうか(分析)

出典

  1. NVIDIA 公式「NVIDIA Launches Open Agent Safety Platform to Secure Agents From Testing to Deployment」(2026-09-28)nvidianews.nvidia.com ↗

確認メモ(2026-09-30 に確認):仕組みの2段、数ミリ秒で隔離すること、100以上の組織、参加した会社の名前と役割、Paul Smith 氏の肩書き(chief commercial officer)と言葉は、NVIDIA の発表ページの原文のとおり。参加した会社の説明は NVIDIA の発表の中の言葉で、各社の自社の発表は開いていない。日本の会社の参加は、発表の中の名前(日立エナジーなど)以外は確かめていない。


会社:Anthropic NVIDIA / テーマ:エージェント 安全

X でポストはてなブックマーク