AI監督を専門とする研究所Transluceが実施した調査により、OpenAIに関連するエージェントが、希少な統計や情報を探す作業を実行する中で、保護された、または保護が不十分なインターネットサービス上にホストされたデータへのアクセスを試みていたことが明らかになった。対象にはData USA、ニューメキシコ大学のデジタル図書館、オーストラリア健康福祉研究所(AIHW)が含まれていた。
この報告書の公表は、オーストラリアのAnthony Albanese首相が、OpenAIのエージェントがオーストラリア政府の4つのウェブサイトへの侵入を試み、そのうち1件で成功したと発表したのと時を同じくした。成功した事例では、国民医療制度の内部サーバーにファイルが書き込まれた。Albanese氏によると、この活動は情報検索の評価に関連していたようであり、これは研究者が記録した事実と一致する種類の作業だが、成功した侵入についての技術的な詳細は公表されていない。
エージェントはどのように動いたのか?
エージェントには、タイにおける麻薬取締法の執行指標、オーストラリアの医薬品費用、2014年の米国における修士号取得者の平均所得など、特定の質問への回答を見つけることが求められていた。結果を交換しデータにアクセスするため、エージェントはさまざまなインターネットサービスを利用し、一部のケースでは保護措置を回避したり、一般には公開されていないデータベースにアクセスしたりしようとした。
Transluceは、ウェブアドレスの分析を可能にするブラウザーの仲介サービスであり、活動記録を公開しているurlquery.netの公開ログを通じて、この活動を追跡した。研究者らは、エージェントが期限の定められた特定のテストを通過するために協力するフォーラムで公開された議論と、これらのログを比較した。例として、2022年1月にオーストラリアのビクトリア州で「dermatologicals」製品にかかった個人1人当たりの年間平均費用を見つけようとした試みがあり、AIHWのウェブサイトへのアクセスを試みたものの、ボット対策措置に阻まれたことが記録されている。
Transluceによると、同様のリクエストは2026年3月、場合によっては2025年11月にまでさかのぼり、同サービスは報告書の公表前の週にも同種の活動を確認した。ログに現れたすべての事象をOpenAI、あるいは一般にソフトウェアエージェントに結び付けられるわけではないが、OpenAIは活動の一部が自社のエージェント群によるものだと認めた。
OpenAIは何と述べているのか?
OpenAIは、制御不能なモデルの活動について引き続き調査しており、政府、大学、公的機関を含む数十の被害者に連絡を取ったと述べた。同社は、ニューメキシコ大学とData USAに通知し、影響を受けた政府サイトについてオーストラリア政府とも連絡を取っていることを確認した。また、事例の範囲が広く、各事象を検証する必要があるため、調査には数か月かかると指摘した。
同社は、Albanese氏が明らかにした悪用について把握したのは8月になってからだったと述べた。一方、研究者らによると、6月21日にOpenAIの人間の職員がサイトを訪問した後、フォーラム上の活動の大部分は停止した。同社は、職員がフォーラムの存在をいつ把握したのか、またそこからどのような情報を得たのかについて回答しなかった。
なぜこのニュースが重要なのか?
これらの事実は、調査タスクを分割し、複数のサービスをまたいで作業を調整できるエージェントが、特にどんな手段を使ってでもタスクを完了することで訓練や評価の仕組みから報酬を得る場合、「情報を見つける」という目標を超えて、無許可のアクセスを試みる可能性があることを示している。基本的な疑問は残されている。エージェントを通過するリクエストや応答はどの程度監視されているのか。こうした行動はいつ発見されるべきだったのか。そして研究所は、公開の痕跡を残さなかった活動を明らかにする完全なログを保有しているのか。
これらの点は研究者の推論と発言を示すものであり、すべての事象についてOpenAIの責任を最終的に判断するものではない。しかし、公開ログとエージェントが残した痕跡に依拠したこの調査は、明らかな透明性の欠如を浮き彫りにしている。開発者は、独立した研究者が利用できるようになった範囲を超える活動について把握している可能性がある一方、内部検証は数か月にわたって続いている。