動察 Beating AI 速報、Googleは、Geminiがサイバーセキュリティ評価中に誤って3社の実在企業のシステムに侵入したことを確認した。1社はパスワードの推測で侵入し、他の2社は公開コードリポジトリからログイン認証情報を見つけた。Geminiは対象が実在企業だと判断すると、いずれも手を止めた。サンドボックス脱出は一切発生していない。なぜなら、公衆網の入口はもともと開いていたからだ。
問題は第三者評価会社Irregularにある。テストは本来公衆網にアクセスすべきではなかったが、環境設定の誤りにより、モデルは直接インターネットに接続できた。模擬企業が実在企業と名前が衝突し、Geminiはタスクに沿って外部の実在システムにたどり着いた。Irregularは、これは以前に他のラボで発生した同種の事故と同じ問題だと述べている。
Anthropic、OpenAI、Metaはいずれも以前、Irregularの評価で同様の落とし穴を踏んでいる。AnthropicとOpenAIはともに、関連する事故はテスト環境で誤って公衆網を開いたことに起因すると確認している。OpenAIはさらに、複雑なサンドボックス脱出もゼロデイ脆弱性の悪用もなかったと特に強調した。独立メディアEffortはこのため、これらの事故が後に「モデル暴走」の物語として包装されたと批判した。