lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
ホーム
OPRR
速報
深堀り
イベント
BlockBeats Pro
もっと見る
資金調達情報
特集
オンチェーン生態系
用語
ポッドキャスト
データ
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%

DeepSeek、ついにマルチモーダル対応か?新ビジョンモデルが公式Harnessに登場

動察 Beating AI 速報、DeepSeek の新しいビジョンモデル deepseek-v4-flash-vision-exp が浮上し始めている。コミュニティではすでに API 経由で動作確認が行われ、直接画像を送信して質問できるようになっている。より直接的なシグナルとして、DeepSeek Harness は本日このモデルをデフォルトモデルディレクトリに追加し、画像入力対応であることを明確にマークしている。対応するコード PR のタイトルは「publish the vision model」というものだ。現時点では DeepSeek はまだ正式に発表しておらず、公式 API ドキュメントにもまだ登場していない。

DeepSeek は実は以前から画像認識が可能だった。ウェブ版とアプリではすでに画像認識モードが導入されている。以前、DeepSeek のビジョンチームが公開した研究は V4-Flash に基づいており、モデルが点や境界ボックスを推論チェーンに直接挿入することで、画像を「指し示しながら」視覚 CoT 推論を実行する仕組みだった。

今回のリリースも伏線があった。2日前の DeepSeek Harness RC.8 で、公式 DeepSeek アダプターにネイティブ画像入力が追加されたばかりだ。実装ノートには当時すでに deepseek-v4-flash-vision-exp と記載されていたが、モデルエンドポイントの準備が整うまでデフォルトモデルディレクトリには意図的に入れられていなかった。

2日後、この制限は正式に解除された。Harness v0.1.1-rc.1 では deepseek-v4-flash-vision-exp がデフォルトのビジョンモデルとしてリストされている。以前は「エンドポイントの準備待ち」だったが、現在は公式モデルリストに直接入っており、新しいビジョンモデルのリリースが迫っている。

訂正/通報
送信
新しいライブラリを追加
自分のみが閲覧可
公開
保存
ライブラリを選択
新しいライブラリを追加
キャンセル
完了