header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
掃碼下載APP

谷歌Gemini 3.8 TTS:30秒樣本就能復刻聲音

動察 Beating AI 快訊,谷歌發布 Gemini 3.8 Flash TTS 和 Flash-Lite TTS,兩款文本轉語音模型已在 Gemini API 和 Google AI Studio 開放。Flash 主打音質、角色表演和長文本穩定性,Lite 偏向高吞吐、低延遲和低成本。


兩款模型都能直接用文字設計新聲線,也能用約 30 秒參考音頻復刻本人或已獲授權的聲音。用戶可以逐句控制情緒、節奏和口音,還能插入笑聲、嘆氣、咳嗽等聲音。雙人對話也可以直接用一份劇本生成。Flash 支持 130 種語言,Lite 支持 101 種。


價格也比上一代低。到 2026 年 12 月 31 日,Flash 音頻輸出每百萬 tokens 為 9 美元,Lite 為 6 美元;上一代 Gemini 3.1 Flash TTS Preview 為 20 美元。2027 年 1 月 1 日起,兩款標準價會升至 18 美元和 12 美元。

举报 糾錯/舉報
糾錯/舉報
提交
新增文庫
僅自己可見
公開
保存
選擇文庫
新增文庫
取消
完成