跳至主要內容
AI 音訊模型
Google
Gemini TTS

Gemini 3.1 Flash TTS

Gemini 3.1 Flash TTS 已確認多說話者對白與聲音控制規格,但最壞情況的輸出音訊用量無法在建立請求前證明,因此目前只保留可索引的詳情頁。

目前暫不支援線上使用

此頁面僅供查看模型功能、適用情境與公開資料;該模型不會出現在首頁工作台,也無法提交生成任務。

目前狀態
預授權受阻
輸入形式
說話者 + 依序對白
呼叫邊界
不建立任務、不扣點
不是 Coming Soon,而是預授權條件尚未完整。
已確認多說話者、對白順序、口音、風格與節奏欄位。
不會進入選擇器、不會建立任務,也不會扣除點數。
30 秒快速瞭解
Gemini TTS
目前無法使用
它擅長什麼
適合較快速語音生成與多角色對白控制的 Gemini TTS 候選模型。
適合哪些使用者
關注 Podcast 對白、旁白和角色語音趨勢,並希望預先準備未來評測腳本的人。
熱門搜尋
Gemini 3.1 Flash TTS 現在能用嗎Gemini 3.1 Flash TTS 多人配音Gemini 3.1 Flash TTS 價格

一句話瞭解

這個模型表現如何?

這不是 Coming Soon,也不是模型下架。目前限制來自站內預授權安全邊界:說話者與對白陣列沒有總量上限,文字到輸出音訊 token 也沒有可證明的最壞情況上限,因此模型不會出現在選擇器中,所有請求都會在扣除點數前遭到拒絕。

它擅長什麼
適合較快速語音生成與多角色對白控制的 Gemini TTS 候選模型。
適合哪些使用者
關注 Podcast 對白、旁白和角色語音趨勢,並希望預先準備未來評測腳本的人。
為什麼要在 Kyeo AI 使用
頁面先公開真實能力與受阻原因;在預授權上限補齊前,不會進入工作區或呼叫介面。

關鍵參數總覽

協助你快速評估此模型是否符合你的業務情境。

廠商
Google
模型家族
Gemini TTS
已確認輸入
說話者設定與依序對白
單段文字
最多 10,000 個字元
目前缺口
輸出音訊 token 最大上限

其他名稱

同一個模型在不同資料中可能有不同名稱,這裡統一整理,方便搜尋與比較。

Gemini Flash TTS
Gemini 3.1 Text to Speech

使用者常見問題

從實際任務、輸入條件和結果要求出發,整理選擇模型時最需要確認的問題。

Gemini 3.1 Flash TTS 現在能用嗎
Gemini 3.1 Flash TTS 多人配音
Gemini 3.1 Flash TTS 價格
Gemini TTS 怎麼用
Gemini TTS 替代模型

選擇指南

還在猶豫該用哪個模型嗎?先查看這幾個關鍵決策點。

1
現在需要生成多人對白

先使用 ElevenLabs Dialogue V3,並以短腳本檢查角色區分。

2
現在需要快速單人配音

先比較 ElevenLabs Turbo 2.5 與 Multilingual V2。

3
準備未來測試

保存旁白、雙人訪談與角色短劇三類非敏感腳本。

使用者常搜尋的比較

把常見候選放在同一任務下比較,協助你確認輸入方式、控制項和成本差異。

Gemini 3.1 Flash TTS 和 ElevenLabs Dialogue V3 怎麼選
Gemini 3.1 Flash TTS 為什麼暫時無法生成
Gemini 3.1 Flash TTS 支援哪些聲音控制

模型橫向比較表

還在猶豫該選哪一個嗎?這張表協助你快速看清目前模型與替代方案的核心差異。

實際使用體驗

結合公開資料、目前站內邊界和典型任務,說明模型適合與不適合的情況。

低延遲定位不能取代費用上限

即使主打速度,缺少輸出音訊 token 的最大上限,仍無法保證預授權足以涵蓋費用。

多角色輸入會擴大最壞情況的用量

陣列總量未受限制時,單段 10,000 個字元不能代表整次請求的總上限。

功能詳解

多說話者設定

規格要求為每位說話者設定識別碼、音色與口音。

依序對白

對白會依序輸出,每段文字都綁定已宣告的說話者。

聲音控制

可描述場景、整體語氣、音訊輪廓、風格與節奏。

適合做什麼

Podcast 對白規劃

為主持人與來賓準備分角色腳本。

角色短劇準備

規劃多人物的依序對白與情緒節奏。

未來同題評測

待開放後比較音色區分、延遲與實際點數。

提示詞技巧

說話者識別碼保持一致

每段對白都必須對應已宣告的說話者。

先用短腳本驗證

先檢查專有名詞、停頓與角色區分,再延長文字。

不要估算輸出時長

文字長度無法直接證明輸出音訊 token 的最大用量。

選擇它的理由

說話者、對白與聲音控制欄位已經明確。
可涵蓋單人旁白與多角色對話的搜尋需求。
詳情展示與實際呼叫維持嚴格隔離。

使用前須知

目前無法建立語音任務或扣除點數。
單段對白雖有 10,000 個字元上限,但說話者與對白陣列沒有總量上限。
輸入 token 價格無法證明輸出音訊 token 的最壞情況費用。

目前無法使用

此頁面僅供查看模型功能、適用情境與公開資料;該模型不會出現在首頁工作台,也無法提交生成任務。 適合較快速語音生成與多角色對白控制的 Gemini TTS 候選模型。

目前頁面沒有額外的前台參數。

常見問題

同類模型推薦

還沒決定該用哪個嗎?也可以比較這幾個同類候選模型。

ElevenLabs Dialogue V3

ElevenLabs Dialogue V3 目前提供逐行對白生成:每行填入台詞並選擇聲音,再依台詞總字元數計費。它不是即時語音代理;官方也提醒可能需要產生多個版本才能選到可用結果。本站建議先用樣本確認角色切換、音訊標籤、語言代碼、輸出格式或長腳本完整性。

AI 音訊模型
14 點數 / 1000 字元

ElevenLabs Turbo 2.5

ElevenLabs Turbo 2.5 是 Kyeo 目前保留的單人文字轉語音工作流程,可選擇站內聲音,並調整 stability、similarity_boost、style、speed、timestamps、前後文與 language_code。它仍可提交,但 ElevenLabs 目前已建議改用 Flash v2.5;頁面不把低延遲、語言支援、時間戳記精度、聲音授權或輸出品質視為 Kyeo 的保證。

AI 音訊模型
6 點數 / 1,000 字元

ElevenLabs Multilingual V2

ElevenLabs Multilingual V2 是 Kyeo AI 目前串接的單人高自然度配音頁。它和 Turbo 2.5 共用近似的前台表單,但真正的任務邊界並不相同:Turbo 更像快速配音基準,Multilingual V2 更像長文字旁白、跨語言內容與品牌長期音色的主力頁。目前站內同樣只提供固定語音角色清單與 5,000 字元串接上限,但決策重點已從速度轉為聽感穩定性,以及是否值得付出雙倍的字數成本。

AI 音訊模型
12 點數 / 1000 字元

資訊來源

頁面內容結合模型資料、功能說明和 Kyeo AI 目前可用設定整理。

來源說明

已確認 Gemini 3.1 Flash TTS 的說話者、對白、聲音控制與 token 費率;但在建立請求前無法證明輸出音訊 token 的最大上限,因此本站暫不開放生成。

最後更新: 2026-08-28
Gemini 3.1 Flash TTS — 暫時無法生成
評測