lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
ホーム
OPRR
速報
深堀り
イベント
BlockBeats Pro
もっと見る
資金調達情報
特集
オンチェーン生態系
用語
ポッドキャスト
データ
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%

GLM-5.3が自身のシステムの最適化を開始、智譜の唐杰氏:RSIの最小閉ループがすでに出現した

動察 Beating AI速報、智譜が明らかにしたところによると、GLM-5.3が駆動するInfra AgentはすでにGLM-5.3-Flashの推論システムの最適化に参加している。初回の動作成功からすべての本番トラフィックを引き受けるまで2週間足らずで、エンドツーエンドのスループットは当初の3.2倍に向上した。


共同創業者兼チーフサイエンティストの唐傑氏は振り返りの中で、Agentが現在最も詰まりやすいところは、多くの場合コードが書けないことではなく、問題がどこにあるか分からないことだと述べた。例えば、ある修正でスループットが20%低下した場合、自分が壊したことは分かっても、どの層で問題が起きたのか、次に何を調べるべきかが分からない。


そこで智譜は、ベテランエンジニアが普段行っている調査方法を、Agentが直接使えるツール一式にした。Agentはコードを修正した後、結果が正しいか、時間がどこで消費されているか、どの方案がより速いかを自分で確認し、その結果に基づいて修正を続けられる。


この方法により、Agentは長コンテキスト計算の誤差、KV転送のブロッキング、デコードkernelの重複計算などの問題を発見した。そのうち1つのkernelは書き直しにより1.71倍の高速化を実現した。


唐傑氏は、エンジニアの役割はますます「フィードバックを設計する人」に近づくと判断している。人間が目標を定め、境界を設定し、高リスクの修正を審査し、Agentが自ら仮説を立て、コードを修正し、実験を走らせる。完全なRSIにはまだほど遠いが、「モデルがシステムを最適化し、システムがさらにモデルにサービスを提供する」という最小閉ループはすでに現れている。

訂正/通報
送信
新しいライブラリを追加
自分のみが閲覧可
公開
保存
ライブラリを選択
新しいライブラリを追加
キャンセル
完了