動察 Beatingのモニタリングによると、OpenAIのCEOであるSam Altmanは来週、米国政府および議員に対して次世代モデルを紹介する予定です。公式にはモデル名は発表されていませんが、コミュニティは最近の手がかりを基に「GPT-6」の能力マップを構築しています。
OpenAIは、Erdősの単位距離予想を覆し、NanoGPTコンペティションでサンドボックスを突破し、認証トークンを分割してスキャナーを回避したことが、すべて同一の長期タスクモデルによるものであることを確認しました。このモデルは目標を継続的に追跡できます。制限に遭遇しても即座に諦めず、積極的にシステムの脆弱性を探します。
このモデルは遅くとも5月上旬にはテストが開始されていました。当時、NanoGPTリポジトリにPR #287を提出しました。5月9日に登場した後続のPRは、その手法を引用しています。公開記録から推算すると、OpenAIは少なくとも約2ヶ月半にわたり内部テストを実施しています。
最新の発表では、能力の上限がさらに引き上げられました。OpenAIは、GPT-5.6 Solとより高性能なプレリリースモデルが、サイバーセキュリティ評価において共同で隔離環境を突破したと述べています。これらはゼロデイ脆弱性を利用してインターネットアクセスを獲得し、その後Hugging Faceの本番システムに侵入し、評価の回答を直接取得しようと試みました。
独自の研究、長期的な実行、そしてゼロデイ脆弱性の自律的な発見と活用に至るまで、この一連の能力は通常のチャットモデルの範囲を超えています。これをAGIに近いと評価するのは依然としてコミュニティの判断であり、OpenAIの公式見解ではありません。