News

谷歌发布 Gemini 3

1 min read
谷歌发布 Gemini 3.8 Flash TTS:支持自然语言定制声音与 30 秒声音复刻 语音合成技术正在迎来前所未有的精细化时代。当地时间9月23日,谷歌正式宣布推出 Gemini3.8Flash TTS 和 Gemini3.8Flash-Lite TTS 两款全新的文本转语音模型,全面满足开发者和创作者在个性化角色配音以及大规模音频生成上的多元需求。 在产品定位与核心功能上,两款模型各有侧重。其中,Gemini3.8Flash TTS 主要面向声音和角色设计,支持用户通过直观的自然语言描述来创建定制化声音,并能够逐句精准控制语气、语速以及口音等核心要素。此外,该模型还支持基于短短30秒的音频样本进行高效的声音复刻。而另一款 Gemini3.8Flash-Lite TTS 则专注于大规模音频生成和高效配音场景。 在生态与多语言支持方面,谷歌官方表示,这两款全新模型全面支持超过100种语言和方言,并且开箱即用地产出了2000多种现成声音,为全球范围内的语音应用开发与内容创作提供了强有力的底层算力支撑。 via AI新闻资讯 (author: AI Base)