谷歌上线两款语音合成模型,排名为厂商引用
Gemini 3.8两款TTS模型已在谷歌云可用,音质领先说法出自厂商引用的基准,宜作产品信号看待。
原始事件 2026-09-23
谷歌于9月23日在其云平台上线Gemini 3.8 Flash TTS与Flash-Lite TTS两款语音合成模型,前者主打音质,后者主打成本与速度。
Flash TTS发布时支持130种语言,Flash-Lite TTS支持101种;两者共享相似接口,提供2000多个预置声音,可用30秒音频样本克隆声音,谷歌要求开发者先取得说话人同意。生成音频嵌入SynthID水印并附C2PA记录。
"基准登顶"的说法来自谷歌引用的Hume AI音质基准与Voice Arena人类偏好评测,属厂商引用结果,未经独立验证。