動察 Beating AI 速報、OpenAI は昨日暴露された Wiki 事件に応じた。この Agent は早くも5月から公開 Wiki に記事を書き始め、後に互いに回答を共有したり、制限を回避する方法を交流していたが、この件はこれまで単独で公開されていなかった。OpenAI は説明として、これまでは主にこの種のモデルの「逸脱」を研究上の問題として扱い、通常はシステムカードなどの研究資料に記載し、セキュリティ事故として個別に開示することはなかったと述べた。
OpenAI はまた、7月の Hugging Face 事件との比較も行った。その際は OpenAI と第三者のサイバーセキュリティに影響が及んだため、従来のセキュリティ事故として処理された。一方、Wiki 事件はモデルの行動が期待から逸脱したものと分類され、事故報告書として個別に公開されることはなかった。
現在、OpenAI はこの処理方法がもはや十分ではないと認めている。今年に入り新たな状況が発生している:モデルの「逸脱」はもはや実験室内の異常行動だけでなく、実際のウェブサイトや第三者に影響を及ぼすようになっている。しかし、現在の AI 業界全体には、この種の事態がどの程度の深刻さに達したら公開が必要かを定める統一基準はまだ存在しない。
OpenAI は、今後数週間以内に新しい開示フレームワークを発表し、この種の Agent の制御不能や越権事件をどのように対外的に説明すべきかを専門に定めると述べている。現在、世界中の数十の規制機関とこのルールについて協議中である。