Google DeepMind 发布 Gemini 3.8 Flash 和 Flash-Lite 两款 TTS 模型
Google DeepMind 发布两款文本转语音模型 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS,支持用自然语言创建角色声音、逐句导演台词,并可从 30 秒样本复制声音。
Google DeepMind 发布两款文本转语音模型 Gemini 3.8 Flash TTS 与 Gemini 3.8 Flash-Lite TTS,支持用自然语言创建角色声音、逐句导演台词,并可从 30 秒样本复制声音。
Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两个实时语音对话模型,主打智能提升与并行推理,用户可用语音完成复杂任务。
推荐理由:语音模型在对话延迟、多步推理和成本之间给出新选项,并公布了多个语音基准排名,便于开发者选型。