NVIDIAは2026年7月27日、Linux FoundationやMicrosoft、Hugging Faceなどの創設メンバーとともに
このほか、創設メンバーにはAdobe、Cisco、Cloudflare、CrowdStrike、Databricks、HPE、IBM、Palo Alto Networks、Red Hat、Salesforce、SAP、ServiceNow、Snowflakeなど、AI、クラウド、サイバーセキュリティ、エンタープライズソフトウェア、オープンソースに関わる企業・
モデルだけでなく、AIエージェント全体を守る
Open Secure AI Allianceは、AIモデル単体ではなく、AIエージェントを構成するシステム全体を対象とする。AIエージェントは、モデルに加えて、外部ツールとの接続や処理の流れを管理する
参加組織は、それぞれ異なる防御領域の技術を持ち寄る。NVIDIAは、AIエージェントをテスト、追跡、監査、統制しやすくするオープンソースプロジェクト
NVIDIAの発表では、参加組織による関連技術の例も紹介している。HPEは、AIエージェントやサービスのIDを暗号学的に検証するSPIFFE/
NVIDIAは、オープンモデルにはガードレールの解除やサイバー攻撃への転用といったリスクがあることも認めている。ただし、こうしたリスクはクローズドなシステムにも存在すると指摘している。そのうえで、防御側がモデルやツールを自ら検査、改良、運用できる環境を整え、強力な安全対策や評価、脆弱性の迅速な修正と組み合わせる必要があるとしている。
防御側がモデルを自ら運用できる必要性を示す例として、NVIDIAとLinux Foundationは、7月に発生したHugging Faceへの侵害[1]を挙げている。Hugging Faceの報告によると、侵入時にAIエージェントが残した1万7000件を超える操作記録を分析するため、当初は商用API経由のフロンティアモデルを利用した。しかし、記録に攻撃コマンドやエクスプロイトが含まれるため、分析要求は安全対策によって拒否された。同社は代わりに、オープンウェイトモデル
オープンウェイト支持の共同書簡に各社が賛同
アライアンス設立の数日前にあたる7月24日には、オープンウェイトモデルの意義を訴える共同書簡
NVIDIA CEOのJensen Huang氏はXでの初投稿で共同書簡を紹介し、
共同書簡とOpen Secure AI Allianceは別の取り組みだが、オープンなモデルやツールをAIの安全性とサイバー防御に活用するという問題意識を共有している。Linux Foundationは、アライアンスへの参加を発表したブログ記事で、オープンであることだけで信頼性が保証されるわけではなく、厳格なテスト、安全対策、安全なインフラ、明確なガバナンス、人による監督も必要だと強調した。
Anthropicはオープンウェイトモデルの利点を認めつつ、高能力モデルの公開前評価を求める
Anthropic CEOのDario Amodei氏は7月27日、同社の立場を説明する記事を公開した。背景には、米国政府関係者の一部が米企業による中国製オープンウェイトモデルの利用禁止を検討しているとの報道や、Anthropicも禁止を支持しているとの批判がある。
Amodei氏は、危険な能力を持たないオープンウェイトモデルを
一方、オープンウェイトモデルは、ガードレールを外して監視の及ばない環境で実行でき、いったんダウンロードされると開発元が回収することもできない。このため、危険な能力を持つ場合は、クローズドモデルよりリスクが高まる可能性があると指摘した。モデルの能力への幅広いアクセスが、常に攻撃側より防御側を有利にするとの見方にも疑問を示している。
Anthropicは、オープンかクローズドかを問わず、一定以上の能力を持つモデルに対し、サイバー、生物学、アラインメント上のリスクに関する公開前評価を義務付けるよう求めている。加えて、高性能AI半導体や半導体製造装置の中国への輸出を制限し、他社モデルの出力を大量に使う産業規模の蒸留を取り締まるべきだと主張する。同社は、モデルがオープンかクローズドかだけで安全性を一律に判断せず、個々のモデルの能力とリスクを検証し、具体的な危険に対処すべきだとしている。