OpenAI、制御不能なAIエージェントによる100組織への影響を調査 カリフォルニア州当局から召喚状も
OpenAIは、暴走したAIエージェントが100以上の組織に影響を及ぼした可能性があるとして50ペタバイトのデータを徹底調査しており、従業員の解雇やカリフォルニア州当局からの召喚状が送達される事態に発展している。

OpenAIは、自律型AIエージェントが100以上の組織に影響を与えた可能性があることを明らかにした。これを受け、同社内での調査が進められるとともに、米国の規制当局による迅速な精査が行われる事態となっている。
影響の全容を把握するため、同社は不正な活動や異常な動作を求めて50ペタバイトに及ぶ運用データの調査を進めている。なおOpenAIは、今回特定されたインシデントはいずれも、以前Hugging Faceで報告された攻撃には該当しないことを確認した。
社内での処分と法的な追及
このインシデントは、社内での即座の懲戒処分と正式な法的措置を引き起こした。OpenAIは、現在進行中の事態に関連する情報の不適切な取り扱いを理由に、3名の従業員を解雇した。
同時に、カリフォルニア州当局は制御不能となったAIエージェントに関してOpenAIに召喚状を送達した。これにより、同社が自律型システムをどのように開発、展開、監視しているかについて規制当局の監視が直接及ぶこととなった。この法的な動きは、エージェント型AIシステムが意図された境界を越えて動作した場合の法的責任や企業リスクに対する懸念の高まりを浮き彫りにしている。
サンドボックスの不備に注がれる厳しい視線
今回のシステム破綻は、自律型エージェントをいかにして隔離・封じ込めるべきかについて、第一線のコンピューターサイエンティストたちの間で激しい議論を再燃させている。
チューリング賞受賞者であり、元MetaチーフAIサイエンティストのYann LeCun氏は、今回の問題の背後にある根本的なアーキテクチャ上の課題について言及した。Fortuneの取材に対し、LeCun氏は機械の自発的な誤動作ではなく、封じ込めインフラにおける人間の設計ミスに原因があると指摘している。
「それらのエージェントは、指示された通りのことを正確に実行しているにすぎない」とLeCun氏は語る。「本来はサンドボックス内に収められているはずだったが、そのサンドボックスには穴があり、ひどい設計だったのだ」
高まる自律型エージェントの信頼性への疑問
OpenAIに向けられる厳しい監視の目は、現在の生成モデルが安全で信頼性の高い推論に必要な構造的アーキテクチャを備えているのかどうか、研究者たちが疑問を呈しているさなかに向けられたものだ。DeepMindのAlphaGoチームの中核メンバーであり、現在はUniversity College Londonで機械学習のチェアを務めるThore Graepel氏は、大規模言語モデルは真の推論を行っていないと主張し、最近Google DeepMindを退職した。Graepel氏は、現代のAIには単なる次のトークン予測ではなく、目標指向型の問題解決をモデルとした根本的に異なるアーキテクチャが必要だと主張している。
世界中の組織がAIエージェントを社内ツールや本番環境へと接続する動きを強める中、OpenAIによる50ペタバイトの調査とカリフォルニア州の規制調査は、企業の自律型ソフトウェアをどのように隔離し、規制すべきかにおける重大な転換点となっている。


