lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
ホーム
OPRR
速報
深堀り
イベント
BlockBeats Pro
もっと見る
資金調達情報
特集
オンチェーン生態系
用語
ポッドキャスト
データ
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%

JinaがDeepSeek-OCRを独自に改良し、自己テストした14モデルの中でページスループットが第1位

動察 Beating AI 速報、Jina AI は文書解析モデル jina-ocr-v1 をリリースし、PDF、スキャン文書、表、グラフを直接 Markdown に変換できる。これは DeepSeek-OCR をベースに事後学習を行い、約34億の総パラメータ、デコード時に各トークンで約5.7億のパラメータを活性化する MoE アーキテクチャを踏襲し、FastMTP 投機的デコーディングを追加している。


Jina の自社テストでは、jina-ocr-v1 は OmniDocBench v1.6 で91.14を記録し、DeepSeek-OCR-2 より0.89ポイント高かった。olmOCR-Bench では83.4を記録し、実際にベースとしている DeepSeek-OCR 底模より7.4ポイント高かった。


スループットは Jina の主要なセールスポイントの一つである。単一の A100、同時実行32で、毎秒2.57ページに達し、Jina がテストした14システムの中で最高であり、DeepSeek-OCR の毎秒2.10ページより約22%高い。


モデルの重みはすでに Hugging Face に公開されており、CC BY-NC 4.0 を採用しており、商用利用には Jina への連絡が必要である。

訂正/通報
送信
新しいライブラリを追加
自分のみが閲覧可
公開
保存
ライブラリを選択
新しいライブラリを追加
キャンセル
完了