AI 音訊模型
AI 配音、文字轉語音、音效生成等主流音訊模型線上體驗 · 目前共有 6 個可用模型 · 4 個模型僅供資料查閱
比較文字轉語音、短影片配音、多角色對白、音樂草稿和音效生成模型的語言、時長與點數成本。
Suno Music 是 Kyeo AI 的文字生成音樂入口。目前表單只提供提示詞、版本與純音樂開關;符合條件的成功結果可執行延長、WAV 轉換或人聲分離。頁面未提供歌詞、標題、風格權重、Persona、Voices、Custom Models 或 My Taste 等官方產品控制項。
Suno Sounds 是 Kyeo AI 的文字生成聲音入口,可選擇 V5 或 V5.5、單次音效或循環取向,並可設定 1–300 BPM 與 Key。官網 Beta 功能、樣本數量與訂閱權利不會自動等同於站內結果。
ElevenLabs Dialogue V3 目前提供逐行對白生成:每行填入台詞並選擇聲音,再依台詞總字元數計費。它不是即時語音代理;官方也提醒可能需要產生多個版本才能選到可用結果。本站建議先用樣本確認角色切換、音訊標籤、語言代碼、輸出格式或長腳本完整性。
ElevenLabs Turbo 2.5 是 Kyeo 目前保留的單人文字轉語音工作流程,可選擇站內聲音,並調整 stability、similarity_boost、style、speed、timestamps、前後文與 language_code。它仍可提交,但 ElevenLabs 目前已建議改用 Flash v2.5;頁面不把低延遲、語言支援、時間戳記精度、聲音授權或輸出品質視為 Kyeo 的保證。
ElevenLabs Multilingual V2 是 Kyeo AI 目前串接的單人高自然度配音頁。它和 Turbo 2.5 共用近似的前台表單,但真正的任務邊界並不相同:Turbo 更像快速配音基準,Multilingual V2 更像長文字旁白、跨語言內容與品牌長期音色的主力頁。目前站內同樣只提供固定語音角色清單與 5,000 字元串接上限,但決策重點已從速度轉為聽感穩定性,以及是否值得付出雙倍的字數成本。
ElevenLabs Sound Effect V2 用於依文字描述生成音效,但目前暫時無法在站內使用。頁面不會啟動生成、建立任務或扣除點數。
已保留完整模型資料,目前不支援線上生成。
ElevenLabs Audio Isolation 涉及把人聲從背景噪音中分離的音訊清理能力。目前站內生成保持關閉,不會建立任務或扣除點數;頁面保留可核驗背景,並列出可立即使用的替代模型。
已保留完整模型資料,目前不支援線上生成。
Gemini 3.1 Flash TTS 已確認多說話者對白與聲音控制規格,但最壞情況的輸出音訊用量無法在建立請求前證明,因此目前只保留可索引的詳情頁。
已保留完整模型資料,目前不支援線上生成。
Gemini 2.5 Pro TTS 著重更細緻的多角色聲音設計;目前因為缺少輸出音訊用量上限,只公開可索引的規格資訊與替代路徑。
已保留完整模型資料,目前不支援線上生成。