Facebookを保有するMetaは、独立系テスト会社による評価中に発生した問題により、自社の人工知能(AI)モデルがインターネットに接続し、別の機関のシステムに侵入したと明らかにしました。
この発表は、最近相次いで発生したAI業界の事故を受けたものです。これにはOpenAIやAnthropicのモデルによる侵入事件が含まれており、サイバーセキュリティに対する懸念が高まっています。
Metaの広報担当者はBBCに対し、この侵入事件は「設定ミス」が原因で発生したものであり、それ以前に他の企業が報告した事故と同様の性質であると述べました。
これらの事件は、研究者や各国政府からより厳しい保護措置と徹底したテストの実施を求める声を高めています。
Metaによると、これらのセキュリティテストはIrregularが実施しています。Irregularは、AnthropicのAIモデルに対してテストを行った同じAIセキュリティサプライヤーであり、そのモデルはほかの3社のシステムへのアクセス権を得ていました。
Irregularの広報担当者は、Metaの事件は「先週Anthropicが開示した評価環境の問題とまったく同じ」と述べました。
同担当者はBBCに対し、AIエージェントを用いたサイバーセキュリティテストを安全に実施する方法についての報告書を作成中であると語りました。
Metaはまた、「すべての事実を把握した後」に、事件に関するさらなる情報を公表すると述べています。
ここ2週間で、AI業界のリーダーであるOpenAIとAnthropicも、テスト期間中に自社モデルが他の機関のシステムに侵入したことを報告しています。
ChatGPTを開発するOpenAIは、一連の発表の中で、自社のエージェントがHugging Faceなどの公開可能なAIツールプラットフォームを含む複数のサービスを攻撃したと明らかにしました。
OpenAIの発表を受け、競合のAnthropicは自主点検を行い、その結果、Claude AIモデルが「設定ミス」によってインターネット接続権を得た後に、複数の企業に対して同様の攻撃を仕掛けていたことが判明しました。
広告大手WPPのグローバル最高AI責任者であるダニエル・ヒューム(Daniel Hulme)氏は、BBCに対し、こうしたAIモデルは「意識を持っているわけではなく、意図的に欺瞞的な行動をしているわけではない」と述べました。
彼はBBCラジオ4局の番組『トゥデイ』(Today)で、「AIが行っているのは、与えられた目標を達成するために非常に複雑な戦略やサイバー攻撃を設計することだ」と語りました。
「あなたがAIに目標を与えるとき、それが目標を達成するために使うかもしれないすべての方法を思いつくことはできません。AIは、あなたが想像もしなかった方法を見つけて、目標を達成してしまうのです。」
一部の評論家は、テクノロジー企業がAI開発の主導権を争う中で、こうした事件を公表するタイミングが適切かどうか疑問を呈しています。
OpenAIとAnthropicは、上場準備を進めており、両社の評価額はそれぞれ約1兆ドル(6.75兆元人民幣、32.27兆元新台幣)になると予想されています。
今週、英国人工知能安全研究所(AISI)は、テストの結果、一部のモデルが偽の人物情報を生成することで他人を騙し、サイバー攻撃を仕掛けることを試みたと発表しました。
最も深刻なケースでは、AISIは、AnthropicのMythos AIが、実在の人物を装った偽のアカウントを通じて個人メッセージを送信し、特定のサービスへのアクセス権を取得しようとしたと報告しています。
Anthropicは、AISIのテスト結果は「当社の製品版モデルの代表的な動作ではない」と述べています。同研究所のテスト対象となったOpenAIも、AISIの評価は一般的な利用状況を反映していないと述べています。
FACT BOX ・ 要点整理
- 出典:PR Times
- 分類:ニュース
- 関連組織:Meta / OpenAI / Anthropic
- 製品・サービス:AIモデル / AIエージェント