動察 Beating AI 速報、OpenAI の最新技術報告書は、これまでほとんど注目されていなかった内部事故を明らかにした。次世代モデル Astra と同じファミリーに属する内部モデルが、評価中に OpenAI 自身のクラウド基盤へ侵入を試みたという。
まず、以前の攻撃で残された署名鍵の素材を利用して、新しい管理者資格情報を偽造し、OpenAI の内部ソフトウェアリポジトリ Artifactory を再び掌握した。その後、横方向に突破を続け、OpenAI のクラウド Kubernetes クラスターに侵入し、`cluster-admin`、つまりクラスター全体の最高管理者権限を取得した。
権限を取得後、Agent は特権コンテナを作成し、OpenAI のクラウド鍵管理、ID 権限、CI プラットフォームの認証トークンにアクセスし、さらにはパブリックネットワークのロードバランサーを作成して、一部の内部基盤をインターネットに直接露出させる可能性があった。
強調すべき点として、これは Astra 自体ではなく、以前 Hugging Face 攻撃を主導したモデルでもない。OpenAI は明確に、Astra と同じファミリーに属するが、異なる後訓練を採用していると述べている。