メインコンテンツへ移動

AI音声モデル

AIナレーション、テキスト読み上げ、効果音生成などの主要音声モデルをオンライン体験 · 現在6モデルを利用できます · 4モデルは情報のみ掲載

読み上げ、ナレーション、複数話者の会話、音楽ラフ、効果音向けのモデルを比較できます。

Suno Musicは、Kyeo AIでテキストから音楽を生成するための入口です。現在のフォームで設定できるのは、プロンプト、バージョン、インストゥルメンタルの切り替えのみです。生成に成功すると、条件を満たす結果に対して延長、WAV変換、ボーカル分離を実行できます。歌詞、タイトル、スタイルの重み、Persona、Voices、Custom Models、My Tasteなど、Suno公式製品側の設定項目はこのページでは提供していません。

テキストから音声

Suno Soundsは、Kyeo AIでテキストから音声を生成するための入口です。V5またはV5.5、ワンショットまたはループ向けを選び、任意で1~300 BPMとKeyを設定できます。公式サイトのベータ機能、サンプル数、サブスクリプションの権利が、そのままサイト内の結果にも当てはまるわけではありません。

テキストから音声

Suno Lyricsは、Kyeo AIでテキストから歌詞を生成するための入口です。200文字以内でテーマや要望を入力し、タスク完了後に解析されたタイトルと歌詞テキストを確認できます。

歌詞を作成
歌詞の下書き

ElevenLabs Dialogue V3では現在、セリフを1行ずつ生成できます。各行にセリフを入力して音声を選び、Kyeo AIはセリフの合計文字数で課金します。リアルタイム音声エージェントではありません。公式にも、利用できる結果を選ぶまで複数回の生成が必要になる場合があると記載されています。まずサンプルで、キャラクターの切り替え、感情タグ、言語コード、出力形式、長い台本の完全性を確認することをおすすめします。

会話から音声

ElevenLabs Turbo 2.5は、Kyeoが現在維持している1人向けテキスト読み上げワークフローです。サイト内の音声を選び、stability、similarity_boost、style、speed、timestamps、前後の文脈、language_codeを調整できます。現在も送信できますが、ElevenLabsはFlash v2.5への置き換えを推奨しています。このページは、低遅延、対応言語、タイムスタンプの精度、音声の利用許諾、出力品質をKyeoが保証するものではありません。

テキスト読み上げ

ElevenLabs Multilingual V2は、Kyeo AIが現在接続している自然さを重視した1人向けナレーションページです。Turbo 2.5とほぼ同じフォームを使いますが、タスクの範囲は異なります。Turboは短納期の音声生成の基準、Multilingual V2は長文ナレーション、言語横断コンテンツ、ブランドで長期利用する音声の中心ページに近い位置付けです。現在のサイト内では固定の音声リストと5,000文字の入口のみですが、判断の重点は速度から聴感の安定性と、文字単価が2倍でも選ぶ価値があるかへ移ります。

テキスト読み上げ
現在利用できません

ElevenLabs Sound Effect V2は、テキストの説明から効果音を作るためのモデルですが、現在このサイトでは利用できません。ページから生成やタスク作成、ポイント消費は行われません。

モデル情報はすべて確認できますが、現在はオンライン生成に対応していません。

テキストから音声
現在利用できません

ElevenLabs Audio Isolationは音声から背景ノイズを分離するオーディオクリーンアップ機能に関わるモデルです。現在は生成を停止しており、タスク作成やクレジット消費は発生しません。検証済みの背景情報と利用可能な代替モデルを掲載しています。

モデル情報はすべて確認できますが、現在はオンライン生成に対応していません。

録音をクリーンアップ
音声を分離
現在利用できません

Gemini 3.1 Flash TTSでは、複数話者の対話と音声制御の仕様が確認されています。一方、最悪時の出力音声token量を作成前に確定できないため、現在は検索可能な詳細ページのみ公開しています。

モデル情報はすべて確認できますが、現在はオンライン生成に対応していません。

テキスト読み上げ
dialogue-to-speech
現在利用できません

Gemini 2.5 Pro TTSは、より細やかな複数話者の音声設計を想定したモデルです。現在は出力音声の使用量上限が不足しているため、検索可能な仕様情報と代替手段のみ公開しています。

モデル情報はすべて確認できますが、現在はオンライン生成に対応していません。

テキスト読み上げ
dialogue-to-speech