メインコンテンツへ移動
AI音声モデル
Google
Gemini TTS

Gemini 2.5 Pro TTS

Gemini 2.5 Pro TTSは、より細やかな複数話者の音声設計を想定したモデルです。現在は出力音声の使用量上限が不足しているため、検索可能な仕様情報と代替手段のみ公開しています。

現在オンラインでは利用できません

このページではモデルの機能、用途、公開情報のみ確認できます。このモデルはトップページのワークベンチには表示されず、生成タスクも送信できません。

現在の状態
現在生成できません
制御できる要素
声質、アクセント、スタイル、テンポ
呼び出し境界
クレジットの差し引き前に拒否
詳細ページは検索可能ですが、実行状態は現在生成不可です。
話者、アクセント、スタイル、テンポ、順序付き対話の各フィールドは確認済みです。
入力tokenの単価を音声生成全体の事前オーソリ額として扱うことはありません。
30秒でわかる
Gemini TTS
現在利用できません
得意なこと
複数話者の声質、スタイル、トーンを細かく制御するためのGemini Pro音声候補です。
おすすめのユーザー
オーディオコンテンツ、キャラクター対話、長文ナレーションに関心があり、厳密な音声評価用サンプルを準備したい方に適しています。
よく検索されているキーワード
Gemini 2.5 Pro TTSは現在使えるかGemini 2.5 Pro TTSの複数話者向け音声Gemini 2.5 Pro TTSの料金

ひとことで紹介

このモデルの特徴

現在の状態はComing Soonではありません。話者と対話の構造は明確ですが、各対話の文字数上限だけでは、リクエスト全体や出力音声の最悪時の使用量を確定できません。そのため、安全な事前オーソリの条件が整うまで、当サイトでは生成入口を提供しません。

得意なこと
複数話者の声質、スタイル、トーンを細かく制御するためのGemini Pro音声候補です。
おすすめのユーザー
オーディオコンテンツ、キャラクター対話、長文ナレーションに関心があり、厳密な音声評価用サンプルを準備したい方に適しています。
Kyeo AIで使うメリット
検索動向と確認済みの仕様を公開しつつ、安全な事前オーソリを確実に行えるまでは、有料の生成機能を提供しません。

主な仕様

このモデルが用途やビジネスに合うか、すばやく判断できます。

提供元
Google
モデルファミリー
Gemini TTS
確認済みの入力
話者設定と順序付き対話
各対話のテキスト
最大10,000文字
現在不足している情報
出力音声tokenの最大値

別名

同じモデルでも資料によって呼び方が異なる場合があります。検索や比較がしやすいよう、ここにまとめています。

Gemini Pro TTS
Gemini 2.5 Pro Text to Speech

よくある質問

タスク、入力条件、必要な結果から、モデルを選ぶ前に確認したい実用的な質問を整理しています。

Gemini 2.5 Pro TTSは現在使えるか
Gemini 2.5 Pro TTSの複数話者向け音声
Gemini 2.5 Pro TTSの料金
Gemini Pro TTSの使い方
Gemini 2.5 Pro TTSの代替モデル

選び方ガイド

どのモデルを使うか迷ったら、まず次のポイントを確認しましょう。

1
複数話者のコンテンツを今すぐ納品したい

まずElevenLabs Dialogue V3を使い、話者の区別とスクリプトのテンポを確認してください。

2
長文ナレーションを今すぐ生成したい

ElevenLabs Multilingual V2とTurbo 2.5を比較してください。

3
提供開始の条件を確認したい

モデル名から推測せず、出力音声の上限確定と事前オーソリの回帰検証完了を基準にしてください。

よく検索される比較

同じタスクで候補を比べ、入力方法、制御項目、コストの違いを確認できます。

Gemini 2.5 Pro TTSとElevenLabs Dialogue V3の違い
Gemini 2.5 Pro TTSが現在使えない理由
Gemini 2.5 Pro TTSで制御できる音声属性

モデル比較表

どれを選ぶか迷っている方のために、現在のモデルと代替候補の主な違いを一覧にしました。

実際の使用感

公開情報、現在のサイト内の範囲、代表的なタスクに基づく実用的な案内です。

Proという位置付けだけでは精算上の不足を解消できない

上位モデルであっても、作成前の事前オーソリが過小にならないことを先に確定する必要があります。

音声制御では評価項目が増える

声質、アクセント、スタイル、テンポは、同じスクリプトを使って項目ごとに比較する必要があります。

機能の詳細

キャラクター音声の設計

話者ごとに声質、アクセント、プロフィール、スタイル、テンポを設定できます。

複数の対話

話者の識別子に紐づけた複数の対話を、指定順に出力します。

場面とトーン

場面と全体の文脈を指定して、目標とする聞こえ方を伝えられます。

おすすめの用途

オーディオコンテンツの設計

長文ナレーションや章立てされたコンテンツ向けに、登場人物とトーンのルールを準備します。

複数話者のインタビュースクリプト

司会者、ゲスト、ナレーターごとにテキストを分けます。

音声案の評価

提供開始後に、自然さ、キャラクターの一貫性、実際のクレジット消費を比較します。

プロンプトのコツ

最初に話者一覧を固定する

同じ話者に複数の異なる識別子を使わないでください。

場面の説明を簡潔にする

最初に全体の聞こえ方を書き、具体的な感情は話者設定に分けてください。

固有名詞は短い文で先に試す

ブランド名、数字、外国語の単語は、まず短いサンプルで確認してください。

選ぶメリット

多面的な音声制御の仕様が明確になっています。
複数話者と長文コンテンツの検索動向を取り込めます。
現在利用できないページから、ユーザーを誤って生成操作へ誘導しません。

利用前の注意点

現在はテキスト読み上げも対話音声の生成も開始できません。
話者と対話の配列に総件数の上限がありません。
入力から出力音声tokenの最大値を確実に導き出せません。

現在利用できません

このページではモデルの機能、用途、公開情報のみ確認できます。このモデルはトップページのワークベンチには表示されず、生成タスクも送信できません。 複数話者の声質、スタイル、トーンを細かく制御するためのGemini Pro音声候補です。

現在、このページで追加設定できる項目はありません。

よくある質問

類似モデル

まだ決まっていない場合は、こちらの類似候補も比較してみてください。

ElevenLabs Dialogue V3

ElevenLabs Dialogue V3では現在、セリフを1行ずつ生成できます。各行にセリフを入力して音声を選び、Kyeo AIはセリフの合計文字数で課金します。リアルタイム音声エージェントではありません。公式にも、利用できる結果を選ぶまで複数回の生成が必要になる場合があると記載されています。まずサンプルで、キャラクターの切り替え、感情タグ、言語コード、出力形式、長い台本の完全性を確認することをおすすめします。

AI音声モデル
1,000文字あたり14クレジット

ElevenLabs Multilingual V2

ElevenLabs Multilingual V2は、Kyeo AIが現在接続している自然さを重視した1人向けナレーションページです。Turbo 2.5とほぼ同じフォームを使いますが、タスクの範囲は異なります。Turboは短納期の音声生成の基準、Multilingual V2は長文ナレーション、言語横断コンテンツ、ブランドで長期利用する音声の中心ページに近い位置付けです。現在のサイト内では固定の音声リストと5,000文字の入口のみですが、判断の重点は速度から聴感の安定性と、文字単価が2倍でも選ぶ価値があるかへ移ります。

AI音声モデル
1,000文字あたり12クレジット

ElevenLabs Turbo 2.5

ElevenLabs Turbo 2.5は、Kyeoが現在維持している1人向けテキスト読み上げワークフローです。サイト内の音声を選び、stability、similarity_boost、style、speed、timestamps、前後の文脈、language_codeを調整できます。現在も送信できますが、ElevenLabsはFlash v2.5への置き換えを推奨しています。このページは、低遅延、対応言語、タイムスタンプの精度、音声の利用許諾、出力品質をKyeoが保証するものではありません。

AI音声モデル
1,000文字あたり6クレジット

情報源

モデル資料、機能説明、Kyeo AIで現在利用できる設定をもとに作成しています。

情報源について

Gemini 2.5 Pro TTSの話者、対話、音声制御、token単価は確認済みです。ただし、リクエスト作成前に出力音声tokenの最大値を確定できないため、当サイトでは現在、生成機能を提供していません。

最終更新: 2026-08-28
Gemini 2.5 Pro TTS — 現在生成できません
レビュー