lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
ホーム
OPRR
速報
深堀り
イベント
BlockBeats Pro
もっと見る
資金調達情報
特集
オンチェーン生態系
用語
ポッドキャスト
データ
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%

ElevenLabs v4がTTSランキングで首位に立ち、GeminiとQwenを超えた

動察 Beating AI 速報、ElevenLabs が次世代音声モデル Eleven v4 とリアルタイム版 Eleven v4 Turbo を発表。v4 はより自然な感情と音声制御を主打とし、Turbo はリアルタイム音声 Agent 向けで、中央値推論遅延は約 100ms。

Artificial Analysis の最新 TTS ブラインドテストランキングで、Eleven v4 は現在 1315 Elo で第 1 位。Cartesia Sonic 3.6 は 1275、Gemini 3.8 Flash TTS は 1267、Qwen-Audio-3.0-TTS-Plus は 1258。前世代の Eleven v3 は現在わずか 1169 で、第 17 位。

v3 はすでに笑い声、ささやきなどの音声タグをサポートしており、v4 は主にこの制御セットをより正確にした。ユーザーはトーン、リズム、感情、効果音を直接指定でき、自然言語で一文をどのように話すかを記述することもできる。モデルは言語カバレッジを 70 以上から 90 以上に拡大し、Instant Voice Clone は約 10 秒の音声のみが必要で、長文や複数人の対話における音声の一貫性も強化された。

Turbo はリアルタイム対話の速度問題を専門に解決する。公式ドキュメントによると、v3 Conversational の中央値推論遅延は約 280ms で、v4 Turbo は約 100ms に低減された。

訂正/通報
送信
新しいライブラリを追加
自分のみが閲覧可
公開
保存
ライブラリを選択
新しいライブラリを追加
キャンセル
完了