メインコンテンツへ移動
AI音声モデル
ElevenLabs
ElevenLabs Dialogue

ElevenLabs Dialogue V3

ElevenLabs Dialogue V3では現在、セリフを1行ずつ生成できます。各行にセリフを入力して音声を選び、Kyeo AIはセリフの合計文字数で課金します。リアルタイム音声エージェントではありません。公式にも、利用できる結果を選ぶまで複数回の生成が必要になる場合があると記載されています。まずサンプルで、キャラクターの切り替え、感情タグ、言語コード、出力形式、長い台本の完全性を確認することをおすすめします。

機能タグ
会話から音声
消費クレジット
1,000文字あたり14クレジット
プロンプト上限
5,000文字
アップロード上限
ファイルのアップロード不要
現在対応するのは`dialogue-to-audio`のみで、リアルタイム会話サービスではない
現在の台本の中心は`dialogue[]`で、各行に`text + voice`が必要
セリフの合計長をJavaScriptの1,000文字あたり`14`クレジットで切り上げ計算
公式推奨は合計2,000文字以内だが、サイト内ページの表示上限は5,000文字
30秒でわかる
ElevenLabs Dialogue
1,000文字あたり14クレジット
得意なこと
現在のサイト内では、Dialogue V3を各行に音声を割り当てる会話生成ページとして扱っています。通常の1人向けTTSやリアルタイム会話サービスではありません。
おすすめのユーザー
ポッドキャストの会話、短編ドラマの台本、キャラクター同士の掛け合い音声、複数人で進行する番組、文ごとに音声を割り当てる会話タスクに適しています。
よく検索されているキーワード
ElevenLabs Dialogue V3の使い方ElevenLabs Dialogue V3の料金ElevenLabs Dialogue V3 複数キャラクターの会話

ひとことで紹介

このモデルの特徴

このサイトでは20種類の音声を選べます。すべてのセリフ行を合計して5,000文字まで、1回のリクエストで使える異なる音声は最大10種類です。出力形式、seed、テキスト正規化、発音辞書は現在設定できません。本番利用の前に、短い台本で検証してください。

得意なこと
現在のサイト内では、Dialogue V3を各行に音声を割り当てる会話生成ページとして扱っています。通常の1人向けTTSやリアルタイム会話サービスではありません。
おすすめのユーザー
ポッドキャストの会話、短編ドラマの台本、キャラクター同士の掛け合い音声、複数人で進行する番組、文ごとに音声を割り当てる会話タスクに適しています。
Kyeo AIで使うメリット
ワークベンチでは各行のセリフと音声選択を分け、合計文字数による料金を表示します。台本構成と予算を確認しやすくなりますが、キャラクターの区別や掛け合いのテンポが期待どおりになることを証明するものではありません。

主な仕様

このモデルが用途やビジネスに合うか、すばやく判断できます。

モデルの種類
AI音声モデル
開発元
ElevenLabs
モデルファミリー
ElevenLabs Dialogue
機能タグ
非同期タスク
消費クレジット
ElevenLabs Dialogue — 非同期タスク
実行方式
非同期タスク
プロンプト上限
5,000文字
アップロード上限
ファイルのアップロード不要

別名

同じモデルでも資料によって呼び方が異なる場合があります。検索や比較がしやすいよう、ここにまとめています。

ElevenLabs Dialogue — ElevenLabs Dialogue V3はポッドキャストの会話に向いているか
Eleven v3
Dialogue Mode

よくある質問

タスク、入力条件、必要な結果から、モデルを選ぶ前に確認したい実用的な質問を整理しています。

ElevenLabs Dialogue V3の使い方
ElevenLabs Dialogue V3の料金
ElevenLabs Dialogue V3 複数キャラクターの会話
ElevenLabs Dialogue V3 dialogue配列
ElevenLabs Dialogue V3 default_voice
ElevenLabs Dialogue V3とTurbo 2.5の違い
ElevenLabs Dialogue V3とMultilingual V2の違い
ElevenLabs Dialogue V3はポッドキャストの会話に向いているか
ElevenLabs Dialogue V3は短編ドラマの音声に向いているか
ElevenLabs Dialogue V3 1,000文字14クレジット

選び方ガイド

どのモデルを使うか迷ったら、まず次のポイントを確認しましょう。

1
優先して選ぶ場面

台本が複数の発話ターンで構成され、行ごとに音声を指定する必要がある場合は、Dialogue V3を短いサンプルで試せます。まず音声の切り替えと完全な出力を確認してから、長さを増やすか決めてください。

2
先にほかのモデルを比較する場面

連続した1人のナレーションでは、まず1人向けTTSを比較してください。リアルタイムに応答する音声エージェントにも適していません。公式にもText to Dialogueはリアルタイム用途ではないと明記されています。

3
最小限の検証手順

まず2種類の音声と少数の発話ターンで、発音、切り替え、途中で切れないか、音声形式、実際の消費クレジットを確認します。

よく検索される比較

同じタスクで候補を比べ、入力方法、制御項目、コストの違いを確認できます。

ElevenLabs Dialogue V3とElevenLabs Multilingual V2の違いと選び方は?
ElevenLabs Dialogue V3 vs ElevenLabs Multilingual V2
ElevenLabs Dialogue V3とElevenLabs Turbo 2.5の違い
ElevenLabs Dialogue V3 vs ElevenLabs Turbo 2.5

モデル比較表

どれを選ぶか迷っている方のために、現在のモデルと代替候補の主な違いを一覧にしました。

現在のサイト内での役割
ElevenLabs Dialogue V3
台本形式の複数キャラクター会話ページ
ElevenLabs Multilingual V2
1人向け多言語TTSのテストページ
ElevenLabs Turbo 2.5
料金の低い1人向けTTSの比較ページ
現在の主な入力
ElevenLabs Dialogue V3
`dialogue[]`の各行に`text + voice`
ElevenLabs Multilingual V2
1つのテキスト + 1人のvoice
ElevenLabs Turbo 2.5
1つのテキスト + 1人のvoice + タイムスタンプ/前後の文脈
現在の料金
ElevenLabs Dialogue V3
1,000文字あたり14クレジット
ElevenLabs Multilingual V2
1,000文字あたり12クレジット
ElevenLabs Turbo 2.5
1,000文字あたり6クレジット
より適した用途
ElevenLabs Dialogue V3
ポッドキャストの会話、短編ドラマ、複数人の掛け合い
ElevenLabs Multilingual V2
1人のナレーションと多言語発音テスト
ElevenLabs Turbo 2.5
料金の低い1人向けTTSサンプル

実際の使用感

公開情報、現在のサイト内の範囲、代表的なタスクに基づく実用的な案内です。

「より高性能なTTS」と誤解されやすいが、実際は異なる

「自然さ、多言語、低遅延」という通常のTTS向けの説明だけでは、このモデルの特徴を正しく伝えられません。

複数人の会話は全体のテンポとキャラクターの区別しやすさで評価

1文だけを聴いて人間らしいか確かめがちですが、Dialogue V3で本当に比較すべきなのは、複数人の掛け合いにおけるテンポ、区別しやすさ、全体の演技感です。単独の声質より、実際の利用可否に近い指標です。

機能の詳細

ElevenLabs Dialogue:明確な入力形式

ElevenLabs Dialogue:明確な入力形式 — Kyeo AIのElevenLabs Dialogue V3を紹介。セリフごとの音声選択、5,000文字の上限、1,000文字あたり14クレジットという実際の料金範囲を確認できます。

音声数と言語コードにはそれぞれ制限がある

このサイトには20種類の音声が表示されますが、公式の1回のリクエストで使える一意の`voice_id`は最大10種類です。

サイト内の料金計算はセリフの文字数のみを集計

このサイトでは`dialogue[]`の各行にあるテキストのJavaScript `length`を合計し、`1,000文字あたり14クレジット`で切り上げます。音声数、言語コード、設定は見積もりに含まれません。

おすすめの用途

短編ドラマとキャラクターの掛け合いサンプル

最初から長い物語を作るのではなく、15~30秒の短い会話でキャラクターの区別と掛け合いのテンポを確かめる用途に適しています。

ポッドキャスト司会者とゲストの掛け合い

2人以上で役割を明確に分け、異なる声質と分かりやすい発話関係が必要な番組の一部分に適しています。

複数キャラクターによる製品紹介やブランドコンテンツ

人物らしさ、掛け合い、より明確なキャラクターの区別が必要な音声コンテンツに適しています。

プロンプトのコツ

1行1セリフで、キャラクターの境界を明確にする

このページで最も重要なのは表現技法ではなく、台本の構成です。各文を誰が話し、どこで止まり、次に誰が続けるかを先に明記してください。

短いサンプルで区別しやすさを確認する

Dialogue V3では、長い物語をそのまま入力するより、まず15~30秒の実際の会話サンプルを作るほうが安定した確認方法です。

デフォルトvoiceは予備であり、主な設定ではない

結果を実際に決めるのは`dialogue[]`の各行にあるvoiceです。`default_voice`は予備に近い項目で、行ごとの割り当てに代わる中心パラメータではありません。

選ぶメリット

現在のサイト内に、明確な`dialogue[]`による複数キャラクター会話のワークフローがある。
セリフの各行にvoiceを個別に割り当てられ、台本形式の掛け合いコンテンツに適している。
短い台本で音声の切り替え、発音、発話ターンの構成をテストできる。
1人向けTTSとは入力構造が異なり、タスクの範囲を見分けやすい。

利用前の注意点

現在は通常の1人向けナレーションページでも、リアルタイム音声エージェントでもない。
公式では合計2,000文字以内を推奨している。Kyeoは最大5,000文字を受け付けるが、長い会話でもより短い文字数から始めることを推奨。
公式では1回につき異なる音声を最大10種類まで使用でき、Kyeoはこの数を超えるリクエストをタスク作成前に拒否する。
本番利用の前に、代表的な台本でキャラクターの区別、テンポ、発音、音声の利用許諾を確認する必要がある。

調整できる項目

このモデルが用途やビジネスに合うか、すばやく判断できます。

デフォルト音声
default_voice
任意
パラメータの種類: select
初期値:pNInz6obpgDQGcFmaJgB
Adam
Alice
Bill
Brian
Callum
Charlie
選択肢20個
安定性
stability
任意
パラメータの種類: select
初期値:0.5
0.0
0.5
1.0
言語コード
language_code
任意
パラメータの種類: text

消費クレジット

1,000文字あたり14クレジット

原価は1000文字あたり14クレジット;ローカル課金は Math.ceil(dialogue[]合計文字数 × 14 / 1000)、min=1クレジット。

クレジット節約のヒント

画像や動画を一括生成する前に、同じ素材を使って現在のモデルと類似候補をA/Bテストするのがおすすめです。効果を確認してから一括処理すれば、クレジットの無駄を抑えられます。

よくある質問

類似モデル

まだ決まっていない場合は、こちらの類似候補も比較してみてください。

ElevenLabs Multilingual V2

ElevenLabs Multilingual V2は、Kyeo AIが現在接続している自然さを重視した1人向けナレーションページです。Turbo 2.5とほぼ同じフォームを使いますが、タスクの範囲は異なります。Turboは短納期の音声生成の基準、Multilingual V2は長文ナレーション、言語横断コンテンツ、ブランドで長期利用する音声の中心ページに近い位置付けです。現在のサイト内では固定の音声リストと5,000文字の入口のみですが、判断の重点は速度から聴感の安定性と、文字単価が2倍でも選ぶ価値があるかへ移ります。

AI音声モデル
1,000文字あたり12クレジット

ElevenLabs Turbo 2.5

ElevenLabs Turbo 2.5は、Kyeoが現在維持している1人向けテキスト読み上げワークフローです。サイト内の音声を選び、stability、similarity_boost、style、speed、timestamps、前後の文脈、language_codeを調整できます。現在も送信できますが、ElevenLabsはFlash v2.5への置き換えを推奨しています。このページは、低遅延、対応言語、タイムスタンプの精度、音声の利用許諾、出力品質をKyeoが保証するものではありません。

AI音声モデル
1,000文字あたり6クレジット

Suno Music

Suno Musicは、Kyeo AIでテキストから音楽を生成するための入口です。現在のフォームで設定できるのは、プロンプト、バージョン、インストゥルメンタルの切り替えのみです。生成に成功すると、条件を満たす結果に対して延長、WAV変換、ボーカル分離を実行できます。歌詞、タイトル、スタイルの重み、Persona、Voices、Custom Models、My Tasteなど、Suno公式製品側の設定項目はこのページでは提供していません。

AI音声モデル
生成/延長:12クレジット/回

情報源

モデル資料、機能説明、Kyeo AIで現在利用できる設定をもとに作成しています。

情報源について

Kyeo AIのElevenLabs Dialogue V3を紹介。セリフごとの音声選択、5,000文字の上限、1,000文字あたり14クレジットという実際の料金範囲を確認できます。 原価は1000文字あたり14クレジット;ローカル課金は Math.ceil(dialogue[]合計文字数 × 14 / 1000)、min=1クレジット。

最終更新: 2026-07-20
ElevenLabsヘルプ:Eleven v3とは
公式
元の情報源を見る
ElevenLabsヘルプ:Dialogue modeとは
公式
元の情報源を見る
ElevenLabsドキュメント:モデル
公式
元の情報源を見る
ElevenLabsドキュメント:Text to Dialogue
公式
元の情報源を見る
ElevenLabs API:会話を作成
公式
元の情報源を見る