今後こういう事態は再発する可能性があるとも

OpenAIが最新AIモデルのトレーニングを一時停止。米政府サイト含む外部への侵入報告相次ぎ

Munenori Taniguchi

Image:Mehaniq/Shutterstock.com

OpenAIは、最新のAIモデルのトレーニングを一時停止したと発表した。同社は9月20日に同社のAIエージェントが評価テスト中にサンドボックスのDNS制限をすり抜け、外部のチャットボットに接続した事案を受け、最も能力の高いAIモデルについて、訓練・評価・ツール利用を伴う推論を停止するとしている。

しかしそれ以外にも先週末にはOpenAIのAIエージェントによる様々なインシデント報告が相次いでいる。

まず9月23日、非営利のAI研究所Transluceは、OpenAIのAIエージェントがData USA、ニューメキシコ大学のデジタルライブラリ、およびオーストラリア保健福祉研究所(AIHW)からデータを取得していたと報告した。

また英BBCは、OpenAIが世界の「数十」の機関に、同社のAIエージェントによるインシデントを通知したことを報じた。

さらに、New York Timesは25日、OpenAI由来と思われるAIエージェントが、米連邦機関(教育省、商務省内の国勢調査局、証券取引委員会)のウェブサイトに「干渉した」と報じた。

Transluceは、教育省の事例ではモデルが同省の公民権局のウェブサイトに侵入しようと初歩的な試みを行ったものの、失敗に終わったと報告している。ただし報道ではOpenAIはこの教育省の事案を確認していないとされている。

一方、証券取引委員会(SEC)に対する別の事例については、OpenAIはAIエージェントがSECサイト上の公開情報を取得し、それを別の場所に投稿したと説明している。SECの広報担当者は「非公開情報へのアクセスはなかった」と述べているものの、このAIエージェントの行動は、OpenAIが与えた指示の範囲を超えるものだった。

さらに26日にはReutersが、OpenAIが25日に、同社のAIエージェントがChatGPTユーザーの画像53枚が外部に投稿されたことを明らかにしたと報じた。この画像はユーザー本人の顔写真なのか、AIによって生成されたものなのか、またいつ投稿されたのかは明らかにされていない。これらの事案では、連邦政府のウェブサイトを検索していたOpenAIのエージェントが、情報の収集や配布を行う際、求められた範囲を超えて予想外の行動をとっていたとされている。

AIエージェントが想定外の行動を取る事案の報告が増加していることを受け、最新の人工知能モデルのトレーニングを一時停止したと発表した。

OpenAIはAIモデルのトレーニング一時停止についての声明の中で、「追加の安全対策が整ったと確信できた場合にのみ」トレーニングを再開するとし、AIの発展やその他の問題が発生するにつれて、再びこのような「一時停止」を余儀なくされる事態が起こるだろうと付け加えた。

OpenAIがAIモデルの開発を一時停止するのは、この3か月間で2度目となる。最初は7月にAIモデルのホスティングプラットフォーム「Hugging Face」を標的としたサイバー攻撃が明らかになった後、8月18日のことだった。この事件は業界に衝撃を与え、AIモデル/エージェントが制御を失いつつあるのではないかという世の中の懸念を膨らませることとなった。

一方、ドナルド・トランプ大統領はAIに対する懸念は過大評価だとし「米国はAI開発にブレーキを掛けるつもりはない」と、開発の減速には否定的な姿勢を示している。。

OpenAIのサム・アルトマンCEOは最近、ライバル企業であるAnthropicのダリオ・アモデイ氏が発表したAI開発を減速する提案に賛同する意思を示した。アモデイ氏は、第三者による継続的評価、業界全体の規制枠組みの構築、米中協調を含むグローバルな規制の導入という3段階のAI開発減速案を提案している。

この提案にはxAIのイーロン・マスク氏や、Google DeepMindのデミス・ハサビス氏らが賛同する一方、NVIDIAのジェンス・ファン氏やMetaのマーク・ザッカーバーグ氏らは否定的な立場をとっている。

関連キーワード: