新模型
2026-09-23
谷歌 Gemini 3.8 上新文字转语音,30 秒克隆你的声音
来源:IT之家 / 网易
谷歌 Gemini 3.8 上新文字转语音,30 秒克隆你的声音
一句话说清:谷歌新出的两款"文字转语音"模型,让你用一句话描述就能生成任意语言、任意角色的声音,拿 30 秒录音还能克隆自己的声音,做播客、有声书、视频配音一下子变简单。
发生了什么
2026 年 9 月 23 日,谷歌发布 Gemini 家族两款全新的文字转语音模型:Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS。
- Flash TTS 主打"创意配音":用一句自然语言提示(比如"带点苏格兰口音、略显疲惫的旁白")就能从头捏出一个新声音,适合游戏角色、有声书、播客。
- Flash-Lite TTS 主打"量大便宜":适合大批量配音、语音客服这类高吞吐场景。
- 核心能力:支持 100 多种语言和方言;自带 2000 多种现成声音;只需 30 秒音频样本就能克隆一个人的声音;还能"逐行写舞台提示",让同一段台词按你的要求演出(平静客服 / 悬疑低语)。
- 声音克隆带同意验证(必须本人口头同意)+ SynthID 水印(听不出来的隐形水印,方便日后辨认这是 AI 生成的音频),算是一道防伪造的安全措施。
来源:IT之家(网易,2026-09-23)、unite.ai(2026-09-23)、多家海外媒体转述。
对我有什么用
- 做自媒体 / 短视频的人:不用再花钱请配音、也不用自己硬着头皮念,写段脚本就能出带情绪的配音。
- 想做播客、有声书的人:可以"捏"一个固定主播声音,每期保持一致,还能用多种语言做外语版。
- 普通用户:克隆自己的声音做语音备忘录、给视频配画外音,玩法很多。
我可以怎么做
- 打开 Google AI Studio(studio.google.com),找到音频 / Audio 入口。
- 在文本框里写一句描述,比如"温柔的女声,普通话,略带笑意",让它生成一段试听。
- 想克隆自己的声音:按提示录一段 30 秒同意声明,系统验证通过后即可生成"你的声音分身"。
- 写一段台词,标好"这里平静、这里紧张",听它逐行演出来。
温馨提醒
- 这是海外产品,国内需要自行解决网络访问环境,别急着找"破解版"。
- 声音克隆功能在部分国家和地区(如美国伊利诺伊州、得克萨斯州、欧洲经济区)不可用,以谷歌页面实时显示为准。
- 水印能防大部分伪造,但音频被反复转码后可能变弱;涉及重要场合(比如用 AI 冒充他人)本就是违规甚至违法的,普通人别拿克隆声音去骗人。
- 具体额度和价格以谷歌官方页面为准,第三方说的"免费"数字别全信。
📤 一键转发小助手
帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发
💬 说说你的看法