メインコンテンツへ移動
AI音声モデル
Google
Gemini TTS

Gemini 3.1 Flash TTS

Gemini 3.1 Flash TTSでは、複数話者の対話と音声制御の仕様が確認されています。一方、最悪時の出力音声token量を作成前に確定できないため、現在は検索可能な詳細ページのみ公開しています。

現在オンラインでは利用できません

このページではモデルの機能、用途、公開情報のみ確認できます。このモデルはトップページのワークベンチには表示されず、生成タスクも送信できません。

現在の状態
事前オーソリで停止中
入力形式
話者設定 + 順序付き対話
呼び出し境界
タスクを作成せず、クレジットも消費しない
Coming Soonではなく、事前オーソリの条件がまだそろっていない状態です。
複数話者、対話順、アクセント、スタイル、テンポの各フィールドは確認済みです。
選択肢には表示せず、タスクも作成せず、クレジットも差し引きません。
30秒でわかる
Gemini TTS
現在利用できません
得意なこと
高速な音声生成と複数話者の対話制御を想定したGemini TTSの候補モデルです。
おすすめのユーザー
ポッドキャスト対話、ナレーション、キャラクターボイスの動向を追いながら、将来の評価用スクリプトを準備したい方に適しています。
よく検索されているキーワード
Gemini 3.1 Flash TTSは現在使えるかGemini 3.1 Flash TTSで複数話者の音声を作れるかGemini 3.1 Flash TTSの料金

ひとことで紹介

このモデルの特徴

Coming Soonでも、提供終了したモデルでもありません。現在の制限は、当サイトの安全な事前オーソリ要件によるものです。話者と対話の配列に総数の上限がなく、テキストから出力音声tokenの最悪値も確定できません。そのため、このモデルは選択肢に表示されず、すべてのリクエストはクレジットを差し引く前に拒否されます。

得意なこと
高速な音声生成と複数話者の対話制御を想定したGemini TTSの候補モデルです。
おすすめのユーザー
ポッドキャスト対話、ナレーション、キャラクターボイスの動向を追いながら、将来の評価用スクリプトを準備したい方に適しています。
Kyeo AIで使うメリット
確認済みの機能と停止理由を先に公開し、事前オーソリに必要な上限が確定するまではワークベンチや呼び出し機能に追加しません。

主な仕様

このモデルが用途やビジネスに合うか、すばやく判断できます。

提供元
Google
モデルファミリー
Gemini TTS
確認済みの入力
話者設定と順序付き対話
各対話のテキスト
最大10,000文字
現在不足している情報
出力音声tokenの最大値

別名

同じモデルでも資料によって呼び方が異なる場合があります。検索や比較がしやすいよう、ここにまとめています。

Gemini Flash TTS
Gemini 3.1 Text to Speech

よくある質問

タスク、入力条件、必要な結果から、モデルを選ぶ前に確認したい実用的な質問を整理しています。

Gemini 3.1 Flash TTSは現在使えるか
Gemini 3.1 Flash TTSで複数話者の音声を作れるか
Gemini 3.1 Flash TTSの料金
Gemini TTSの使い方
Gemini TTSの代替モデル

選び方ガイド

どのモデルを使うか迷ったら、まず次のポイントを確認しましょう。

1
今すぐ複数話者の対話を生成したい

まずElevenLabs Dialogue V3を使い、短いスクリプトで話者を聞き分けられるか確認してください。

2
今すぐ単一話者の音声をすばやく生成したい

ElevenLabs Turbo 2.5とMultilingual V2を比較してください。

3
将来のテストを準備したい

ナレーション、二人のインタビュー、キャラクター寸劇の三種類について、機密情報を含まないスクリプトを保存しておきましょう。

よく検索される比較

同じタスクで候補を比べ、入力方法、制御項目、コストの違いを確認できます。

Gemini 3.1 Flash TTSとElevenLabs Dialogue V3はどう選ぶか
Gemini 3.1 Flash TTSで現在生成できない理由
Gemini 3.1 Flash TTSで制御できる音声要素

モデル比較表

どれを選ぶか迷っている方のために、現在のモデルと代替候補の主な違いを一覧にしました。

実際の使用感

公開情報、現在のサイト内の範囲、代表的なタスクに基づく実用的な案内です。

低遅延という位置付けだけでは料金上限を決められない

速度を重視するモデルでも、出力音声tokenの最大値がなければ、事前オーソリで費用を確実にカバーできません。

複数話者の入力では最悪時の利用量が増える

配列全体の件数に制限がない場合、各対話が10,000文字以内でも、リクエスト全体の上限にはなりません。

機能の詳細

複数話者の設定

話者ごとに識別子、声質、アクセントを設定する仕様です。

順序付き対話

対話は指定順に出力され、各テキストは登録済みの話者に紐づきます。

音声制御

場面、全体のトーン、音声プロフィール、スタイル、テンポを指定できます。

おすすめの用途

ポッドキャスト対話の設計

司会者とゲストを分けたスクリプトを準備します。

キャラクター寸劇の準備

複数の登場人物による順序付き対話と感情のテンポを設計します。

同一条件での将来比較

提供開始後に、声質の区別、遅延、実際のクレジット消費を比較します。

プロンプトのコツ

話者の識別子を統一する

各対話は、事前に登録した話者のいずれかに必ず対応させてください。

まず短いスクリプトで試す

固有名詞、間の取り方、話者の区別を確認してから、テキストを長くしてください。

出力時間を推定しない

テキストの長さだけでは、出力音声tokenの最大使用量を確定できません。

選ぶメリット

話者、対話、音声制御の各フィールドが明確になっています。
単一話者のナレーションと複数話者の対話、両方の検索ニーズをカバーできます。
詳細情報の公開と実際の呼び出しを厳密に分離しています。

利用前の注意点

現在は音声タスクを作成できず、クレジットも差し引かれません。
各対話には10,000文字の上限がありますが、話者と対話の配列全体には件数の上限がありません。
入力tokenの単価だけでは、出力音声tokenの最悪時の費用を確定できません。

現在利用できません

このページではモデルの機能、用途、公開情報のみ確認できます。このモデルはトップページのワークベンチには表示されず、生成タスクも送信できません。 高速な音声生成と複数話者の対話制御を想定したGemini TTSの候補モデルです。

現在、このページで追加設定できる項目はありません。

よくある質問

類似モデル

まだ決まっていない場合は、こちらの類似候補も比較してみてください。

ElevenLabs Dialogue V3

ElevenLabs Dialogue V3では現在、セリフを1行ずつ生成できます。各行にセリフを入力して音声を選び、Kyeo AIはセリフの合計文字数で課金します。リアルタイム音声エージェントではありません。公式にも、利用できる結果を選ぶまで複数回の生成が必要になる場合があると記載されています。まずサンプルで、キャラクターの切り替え、感情タグ、言語コード、出力形式、長い台本の完全性を確認することをおすすめします。

AI音声モデル
1,000文字あたり14クレジット

ElevenLabs Turbo 2.5

ElevenLabs Turbo 2.5は、Kyeoが現在維持している1人向けテキスト読み上げワークフローです。サイト内の音声を選び、stability、similarity_boost、style、speed、timestamps、前後の文脈、language_codeを調整できます。現在も送信できますが、ElevenLabsはFlash v2.5への置き換えを推奨しています。このページは、低遅延、対応言語、タイムスタンプの精度、音声の利用許諾、出力品質をKyeoが保証するものではありません。

AI音声モデル
1,000文字あたり6クレジット

ElevenLabs Multilingual V2

ElevenLabs Multilingual V2は、Kyeo AIが現在接続している自然さを重視した1人向けナレーションページです。Turbo 2.5とほぼ同じフォームを使いますが、タスクの範囲は異なります。Turboは短納期の音声生成の基準、Multilingual V2は長文ナレーション、言語横断コンテンツ、ブランドで長期利用する音声の中心ページに近い位置付けです。現在のサイト内では固定の音声リストと5,000文字の入口のみですが、判断の重点は速度から聴感の安定性と、文字単価が2倍でも選ぶ価値があるかへ移ります。

AI音声モデル
1,000文字あたり12クレジット

情報源

モデル資料、機能説明、Kyeo AIで現在利用できる設定をもとに作成しています。

情報源について

Gemini 3.1 Flash TTSの話者、対話、音声制御、token単価は確認済みです。ただし、リクエスト作成前に出力音声tokenの最大値を確定できないため、当サイトでは現在、生成機能を提供していません。

最終更新: 2026-08-28
Gemini 3.1 Flash TTS — 現在生成できません
レビュー