lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
ホーム
OPRR
速報
深堀り
イベント
BlockBeats Pro
もっと見る
資金調達情報
特集
オンチェーン生態系
用語
ポッドキャスト
データ
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%

DeepSeekは8兆パラメータのモデルを訓練する計画で、規模は既存の最大オープンソースモデルのほぼ3倍に達する。

動察 Beating AI 速報、DeepSeek がまたモデルを巨大化しようとしている。CEO の梁文鋒氏が投資家に明かしたところによると、同社は現在 2 兆パラメータのモデルを訓練中で、その後さらに 8 兆パラメータのモデルを開発する計画だという。現行のフラッグシップ V4-Pro はわずか 1.6 兆パラメータに過ぎない。


8 兆とはどのような概念か?現在すでに重みが公開されている超大型モデルの中では、Moonshot AI の Kimi K3 が 2.8 兆パラメータに達し、すでに世界最大のオープンソースモデルとなっている。DeepSeek が計画中の 8 兆モデルは、規模がさらに約 3 倍大きくなる。


ただし、総パラメータが多いからといって、毎回の実行ですべてのパラメータを呼び出すわけではない。Kimi K3 は MoE アーキテクチャであり、2.8 兆の総パラメータのうち各トークンで活性化されるのはわずか 1040 億である。

訂正/通報
送信
新しいライブラリを追加
自分のみが閲覧可
公開
保存
ライブラリを選択
新しいライブラリを追加
キャンセル
完了