lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
ホーム
OPRR
速報
深堀り
イベント
BlockBeats Pro
もっと見る
資金調達情報
特集
オンチェーン生態系
用語
ポッドキャスト
データ
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%

グーグルはAgentに「夢を見る」ことを学ばせた:過去の試行錯誤を振り返り、次のラウンドでは自ら遠回りを減らす。

動察 Beating AI 速報、Googleの研究チームがDream-RSIを発表した。AI Agentが1ラウンドのタスクを終えた後、過去の成功と失敗を「夢見る」ように活用する。システムは毎回の試行と結果を保存し、それらの古い記録を使って異なるアプローチを推演する。例えば、どの道を先に試すか、いつ諦めるか、複数の案を同時に試すかどうかなどだ。結果は以前にすでに実行済みであるため、これらの推演はタスクを再実行する必要がない。


システムはそこからより良いパフォーマンスのアプローチを選び、次のラウンドに直接適用する。新しいラウンドではさらに多くの成功と失敗が残され、それをまた「夢見る」ことに使い、戦略を改善し続ける。こうしてラウンドを重ねることが、論文でいう「再帰的自己改善」である。現在、基盤モデル自体は変化せず、実際に改善されるのはAgentの「次にどうするか」という方法である。


論文では、アルゴリズム、数学的最適化、GPU kernelなど8つのタスクでこの方法をテストした。Gemini 3.1 Proのあるアルゴリズムタスクを例にとると、固定アプローチと比較して、Agentの呼び出しが550回から317回に減少し、同時に最終的に見つかったプログラムはより速く動作した。

訂正/通報
送信
新しいライブラリを追加
自分のみが閲覧可
公開
保存
ライブラリを選択
新しいライブラリを追加
キャンセル
完了