lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
ホーム
OPRR
速報
深堀り
イベント
BlockBeats Pro
もっと見る
資金調達情報
特集
オンチェーン生態系
用語
ポッドキャスト
データ
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%

バイトダンスのSeed Audio1.0がリリース:1つのプロンプトで台詞、効果音、環境音を生成可能

動察Beatingのモニタリングによると、ByteDance Seedが音声生成モデル「Seed Audio 1.0」を発表した。このモデルは、1つのプロンプトで台詞、効果音、環境音を同時に生成し、タイムラインに沿って音声の入力を制御できる。

このモデルはテキストと参照音声の入力をサポートし、時間制御の精度は100ms。1回の生成で約2分間の音声を生成でき、さらに延長してキャラクターの声色の一貫性を保つことも可能。

Seed Audio 1.0は20以上の言語をサポート。同じ声色を言語間で移行でき、口調や感情の切り替えも可能。

公式評価によると、ほとんどのシナリオで音声の使用可能率が90%を超えている。ほとんどの言語の自然度MOSは4点以上。このモデルはすでに火山方舟体験センターに搭載され、API接続も開放されている。

訂正/通報
送信
新しいライブラリを追加
自分のみが閲覧可
公開
保存
ライブラリを選択
新しいライブラリを追加
キャンセル
完了