AIニュース

「暴走モデル」封じ込め計画、主要AI企業はいまだ非公開 Guidelight調査で判明

公開日: ・出典: TechCrunch

TechCrunchが8月22日に報じたところによると、AI安全基準の普及を掲げる非営利団体Guidelight AI Standardsが、OpenAI・Anthropic・Google・Meta・xAIという主要5社を対象に、AIモデルが人間の制御から逸脱した場合にどう対応するかを定めた「封じ込め計画」の公開状況を調査しました。調査は各社が一般に公開している文書のみをもとに、AIエージェントの行動ログの記録・監視体制、危険な兆候が続いた際にシステムを停止する仕組み、外部の第三者による監査の有無、そして実際にモデルの制御が効かなくなった場合の具体的な対応計画という複数の観点から評価する形で行われました。

調査結果によれば、いずれの企業についても、評価対象となった項目すべてで十分な対応ができているとは認められませんでした。特にMetaについては、封じ込め計画の存在を示す公開情報が見当たらないとされ、Anthropicについても、同社が8月に公表したリスクレポートの中でモデルの展開を制限するといった対応策への言及が見られない点が指摘されています。一方でOpenAIは、過去に安全上の懸念を理由に社内のモデル展開や学習を一時停止・終了させた実績が複数回あるとされ、他社と比べて相対的に評価された項目もありました。またGoogleは実装面では遅れが見られるものの、予防・検知・封じ込めの各段階を網羅した将来計画「AI Control Roadmap」を公表しており、この点は他社にはない特徴として言及されています。

カリフォルニア州のSB53法や、来年1月に施行予定のニューヨーク州RAISE法など、フロンティアAIを開発する企業に安全上の重大インシデントへの対応枠組みの公表を義務付ける規制が相次いで導入されつつある中、GoogleとOpenAIはいずれも、今回の調査結果が自社の内部的な取り組みの実態をすべて反映しているわけではないとコメントしています。AIエージェントが独自に判断し行動する場面が広がるにつれ、「暴走したAIをどう止めるか」という具体的な計画の透明性は、規制当局だけでなく利用企業にとっても重要な判断材料になりつつあります。

出典: TechCrunch

Xでシェア