跳到主要内容
AI 音频模型
Google
Gemini TTS

Gemini 3.1 Flash TTS

Gemini 3.1 Flash TTS 已确认多说话人对白与声音控制合同,但最坏输出音频用量无法在创建前证明,因此目前只保留可索引详情页。

当前暂不支持在线使用

此页面仅用于查看模型能力、适用场景与公开资料;该模型不会出现在首页工作台,也无法提交生成任务。

当前状态
预授权阻断
输入形态
说话人 + 顺序对白
调用边界
不创建任务、不扣点
不是 Coming Soon,而是预授权条件尚不完整。
已确认多说话人、对白顺序、口音、风格与节奏字段。
不进入选择器,不创建任务,也不扣除积分。
30 秒了解
Gemini TTS
当前不可用
它擅长什么
面向较快语音生成与多角色对白控制的 Gemini TTS 候选。
适合谁用
关注播客对白、旁白和角色语音趋势,并希望提前准备未来评测脚本的人。
大家都在搜
Gemini 3.1 Flash TTS 现在能用吗Gemini 3.1 Flash TTS 多人配音Gemini 3.1 Flash TTS 价格

一句话了解

这个模型怎么样?

这不是 Coming Soon,也不是模型下线。当前限制来自站内预授权安全边界:说话人与对白数组没有总量上限,文本到输出音频 token 也没有可证明的最坏上界,因此模型不进入选择器,所有请求会在扣点前拒绝。

它擅长什么
面向较快语音生成与多角色对白控制的 Gemini TTS 候选。
适合谁用
关注播客对白、旁白和角色语音趋势,并希望提前准备未来评测脚本的人。
为什么在 Kyeo AI 用
页面先公开真实能力和阻断原因;在预授权上界补齐前不进入工作台或调用接口。

关键参数一览

帮你快速评估这个模型和你的业务场景是否匹配。

厂商
Google
模型家族
Gemini TTS
已确认输入
说话人配置与顺序对白
单段文字
最多 10,000 字符
当前缺口
最大输出音频 token 上界

它还叫什么

同一个模型在不同资料里可能有不同叫法,这里统一整理,方便搜索和比较。

Gemini Flash TTS
Gemini 3.1 Text to Speech

用户常见问题

从实际任务、输入条件和结果要求出发,整理选择模型时最需要确认的问题。

Gemini 3.1 Flash TTS 现在能用吗
Gemini 3.1 Flash TTS 多人配音
Gemini 3.1 Flash TTS 价格
Gemini TTS 怎么用
Gemini TTS 替代模型

选型指南

还在纠结用哪个模型?先看这几个关键决策点。

1
现在需要生成多人对白

先使用 ElevenLabs Dialogue V3,并用短脚本检查角色区分。

2
现在需要快速单人配音

先比较 ElevenLabs Turbo 2.5 与 Multilingual V2。

3
准备未来测试

保存旁白、双人访谈和角色短剧三类非敏感脚本。

用户常搜的对比

把常见候选放在同一任务下比较,帮助你确认输入方式、控制项和成本差异。

Gemini 3.1 Flash TTS 和 ElevenLabs Dialogue V3 怎么选
Gemini 3.1 Flash TTS 为什么暂不可生成
Gemini 3.1 Flash TTS 支持哪些声音控制

模型横向对比表

正在纠结选哪个?这张表帮你一眼看清当前模型和替代方案的核心差异。

实际使用体验

结合公开资料、当前站内边界和典型任务,说明模型适合与不适合的情况。

低延迟定位不能替代费用上界

即使强调速度,没有最大输出音频 token 仍不能保证预授权覆盖。

多角色输入扩大最坏用量

数组总量未限制时,单段 10,000 字符不能代表整次请求的总上界。

能力详解

多说话人配置

合同要求为每个说话人设置标识、音色与口音。

顺序对白

对白按顺序输出,每段文字绑定已声明说话人。

声音控制

可描述场景、整体语气、音频画像、风格与节奏。

适合做什么

播客对白规划

为主持人与嘉宾准备分角色脚本。

角色短剧准备

规划多人物顺序对白和情绪节奏。

未来同题评测

待开放后比较音色区分、延迟与实际积分。

提示词技巧

说话人标识保持一致

每段对白必须对应已声明的说话人。

先用短脚本验证

先检查专有名词、停顿和角色区分,再扩长文本。

不要估算输出时长

文字长度不能直接证明最大音频 token 用量。

为什么选它

说话人、对白和声音控制字段已经明确。
可覆盖单人旁白与多角色对话搜索意图。
详情展示与实际调用保持严格隔离。

使用前要知道

当前不能创建语音任务或扣除积分。
单段对白虽有 10,000 字符上限,但说话人和对白数组没有总量上限。
输入 token 价格不能证明输出音频 token 的最坏费用。

当前不可用

此页面仅用于查看模型能力、适用场景与公开资料;该模型不会出现在首页工作台,也无法提交生成任务。 面向较快语音生成与多角色对白控制的 Gemini TTS 候选。

当前页面暂无额外前台参数。

常见问题

同类模型推荐

还没决定用哪个?顺手对比一下这几个同类候选。

ElevenLabs Dialogue V3

ElevenLabs Dialogue V3 当前提供逐行对白生成:每行填写台词并选择声音,Kyeo AI 按台词总字符数计费。它不是实时语音代理;官方也提示可能需要多次生成才能选到可用结果。本站建议先用样本确认角色切换、情绪标签、语言代码、输出格式或长脚本完整性。

AI 音频模型
14 积分 / 1000 字符

ElevenLabs Turbo 2.5

ElevenLabs Turbo 2.5 是 Kyeo 当前保留的单人文字转语音工作流,可选择站内声音并调整 stability、similarity_boost、style、speed、timestamps、前后文和 language_code。它仍可提交,但 ElevenLabs 当前已推荐以 Flash v2.5 取代;页面不把低延迟、语言支持、时间戳精度、声音授权或输出质量视为 Kyeo 的保证。

AI 音频模型
6 积分 / 1,000 字符

ElevenLabs Multilingual V2

ElevenLabs Multilingual V2 是 Kyeo AI 当前接入的单人高自然度配音页。它和 Turbo 2.5 共用近似的前台表单,但真正的任务边界并不一样:Turbo 更像快配音基线,Multilingual V2 更像长文本旁白、跨语言内容和品牌长期音色的主力页。当前站内它同样只走固定语音角色列表和 5,000 字符接入口,但决策重点已经从速度切到听感稳定性和值不值得付双倍字数成本。

AI 音频模型
12 积分 / 1000 字符

信息来源

页面内容结合模型资料、功能说明和 Kyeo AI 当前可用设置整理。

来源说明

已确认 Gemini 3.1 Flash TTS 的说话人、对白、声音控制与 token 费率;但创建请求前无法证明最大输出音频 token 上界,因此本站暂不开放生成。

最后更新: 2026-08-28
Gemini 3.1 Flash TTS — 暂不可生成
评测