動察 Beating AI 速報、ワールドモデル企業OdysseyがOdyssey-3を正式に発表し、Flash版の無料試遊を開放した。テキストからリアルタイムで探索可能な世界を生成できる。ユーザーが歩いたりカメラを回したりすると、映像がそれに合わせて変化する。チームはまた、同じモデルをロボットアーム、ヒューマノイドロボット、自動車、ゲームキャラクターに応用する実験も披露した。
Odyssey-3はまずインターネット動画、ゲーム操作録画、物理シミュレーションから物体の運動と行動の結果を学習する。ロボットや自動車に使用する場合、事前学習済みのメインモデルのパラメータは変わらない。チームは追加で小型制御モジュールを訓練するだけで、モデルが学習した知識を操作指令に変換できる。異なるマシンには個別の適応が依然として必要だが、モデル全体を再訓練する必要はない。
Odysseyはわずか20時間の模擬運転データで専用制御モジュールを訓練し、インドの実道路で自動車を走行させることに成功した。テストでは、模擬データ訓練方案の安全員による2回の介入間の走行距離は、実運転録画訓練方案の約77%であった。
Flexionと協力したヒューマノイドロボットは、数十時間の遠隔操作模範データで訓練した後、照明変化の下でもタスクを継続実行できる。ゲーム実験では、制御モジュールが約2時間の『GTA V』操作録画を学習。その後、追加訓練なしで『荒野の大西部2』においてキャラクターを馬で移動させることができた。
Physics-IQ Verified物理動画予測テストにおいて、Odyssey-3 Proは66.1点を獲得し、FLUX 3 [large]の64.35点を上回った。いずれも8回のベスト選択成績である。OdysseyはまたWorldMark評価結果を公表し、モデルは4種類のインタラクションシーンで3項目の第1位を獲得した。