lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
ホーム
OPRR
速報
深堀り
イベント
BlockBeats Pro
もっと見る
資金調達情報
特集
オンチェーン生態系
用語
ポッドキャスト
データ
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%

グーグルGemini 3.8 TTS:30秒のサンプルで声を複製可能

動察 Beating AI 速報、GoogleはGemini 3.8 Flash TTSとFlash-Lite TTSを発表し、2つのテキスト読み上げモデルがGemini APIとGoogle AI Studioで公開された。Flashは音質、キャラクターパフォーマンス、長文の安定性を重視し、Liteは高スループット、低遅延、低コストに傾いている。


両モデルともテキストから直接新しい声を作成でき、約30秒の参照音声で本人または許諾を得た声をクローンできる。ユーザーは文ごとに感情、リズム、アクセントを制御でき、笑い声、ため息、咳などの音も挿入可能。二人の対話も1つの台本から直接生成できる。Flashは130言語、Liteは101言語に対応。


価格も前世代より低い。2026年12月31日まで、Flashの音声出力は100万トークンあたり9ドル、Liteは6ドル。前世代のGemini 3.1 Flash TTS Previewは20ドルだった。2027年1月1日から、両モデルの標準価格は18ドルと12ドルに上がる。

訂正/通報
送信
新しいライブラリを追加
自分のみが閲覧可
公開
保存
ライブラリを選択
新しいライブラリを追加
キャンセル
完了