跳到正文
原文
Google DeepMind Blog·· 2026-04-16精选AI 评分69

Google 发布 Gemini 3.1 Flash TTS 文本转语音模型

Gemini 3.1 Flash TTS: the next generation of expressive AI speech

AI 导读

Google 发布 Gemini 3.1 Flash TTS,并通过 Gemini API、Google AI Studio 和 Vertex AI 推出预览,面向 Workspace 用户经由 Google Vids 提供。模型支持多说话者对话、70 多种语言和可嵌入文本的 audio tags;所有生成音频均带有 SynthID 水印。

推荐理由

正式发布信息明确了预览渠道、语言支持、音频标签与 SynthID 等关键细节,开发者可据此评估语音应用的集成方式与控制能力。

来源:Google DeepMind Blog · deepmind.google