google/gemini-3.1-flash-tts-preview
日耗榜 #333
google
google/gemini-3.1-flash-tts-preview
用量数据日期 2026-09-12 · 每日更新
用量与规格
日耗榜排名#333
日 Tokens291.3M
日请求818.4K
日变化
−6.0%
google/gemini-3.1-flash-tts-preview 是什么
模型:Gemini 3.1 Flash TTS Preview 介绍:Gemini 3.1 Flash TTS Preview 是 Google 推出的文本转语音模型,相比 Gemini 2.5 Flash TTS 实现了显著的代际提升。它接收文本输入,可生成超过 70 种语言的音频输出——语言覆盖范围是前代产品的近 3 倍。 核心新增功能是一套包含 200 多种内联音频标签(例如 `[whispers]`、`[laughs]`、`[excited]`)的系统,让开发者能够在句子中间控制表达方式、情感和节奏,同时 Google AI Studio 中新增了“导演椅”工作流,用于定义每个角色的音频配置文件和场景级上下文。它支持最多两个说话人,每个说话人可独立配置语音和风格,输出 24 kHz / 16-bit 单声道 PCM 音频,并使用 SynthID 自动为所有输出添加水印。上下文窗口为 32k tokens。