Ir al contenido principal
Modelo de audio con IA
ElevenLabs
ElevenLabs Dialogue

ElevenLabs Dialogue V3

ElevenLabs Dialogue V3 genera actualmente diálogos línea por línea: en cada línea se escribe el texto y se elige una voz, y Kyeo AI factura según el total de caracteres del diálogo. No es un agente de voz en tiempo real; la información oficial también advierte que puede ser necesario generar varias veces para encontrar un resultado útil. Recomendamos empezar con una muestra para comprobar los cambios de personaje, las etiquetas de emoción, el código de idioma, el formato de salida y la integridad de guiones largos.

Función
Diálogo a audio
Consumo de créditos
14 créditos / 1.000 caracteres
Límite del prompt
5.000 caracteres
Límite de carga
No requiere archivos
Actualmente solo admite `dialogue-to-audio`; no es un servicio de conversación en tiempo real
La estructura principal del guion es `dialogue[]`, y cada línea debe incluir `text + voice`.
La longitud total del diálogo se cobra a `14` créditos por cada 1.000 caracteres de JavaScript, redondeando hacia arriba
La recomendación oficial es no superar 2.000 caracteres totales, mientras que la página de la plataforma indica 5.000
Resumen en 30 segundos
ElevenLabs Dialogue
14 créditos / 1000 caracteres
En qué destaca
La plataforma presenta Dialogue V3 como una página de generación de diálogos que asigna una voz a cada línea, no como un TTS convencional para una sola voz ni un servicio de conversación en tiempo real.
Para quién es
Adecuado para diálogos de pódcast, guiones de minidramas, audio con interacción entre personajes, programas narrados por varias personas y tareas que requieren asignar una voz a cada línea.
Búsquedas populares
cómo usar ElevenLabs Dialogue V3precio de ElevenLabs Dialogue V3diálogo de varios personajes en ElevenLabs Dialogue V3

En pocas palabras

¿Qué ofrece este modelo?

La plataforma ofrece 20 voces, aplica un límite total de 5.000 caracteres a todas las líneas y restringe cada solicitud a un máximo de 10 voces distintas. Los controles de formato de salida, seed, normalización de texto y diccionario de pronunciación aún no están disponibles. Valida primero un guion corto antes de usarlo en un trabajo final.

En qué destaca
La plataforma presenta Dialogue V3 como una página de generación de diálogos que asigna una voz a cada línea, no como un TTS convencional para una sola voz ni un servicio de conversación en tiempo real.
Para quién es
Adecuado para diálogos de pódcast, guiones de minidramas, audio con interacción entre personajes, programas narrados por varias personas y tareas que requieren asignar una voz a cada línea.
Por qué usarlo en Kyeo AI
El espacio de trabajo separa el texto y la selección de voz de cada línea y muestra la facturación por caracteres totales, lo que ayuda a revisar la estructura y el presupuesto. Esto no demuestra que la diferenciación entre personajes o el ritmo de los turnos cumplan siempre las expectativas.

Parámetros principales

Te ayuda a evaluar rápidamente si este modelo encaja con tu caso de uso.

Categoría del modelo
Modelo de audio con IA
Desarrollador
ElevenLabs
Familia del modelo
ElevenLabs Dialogue
Función
Tarea asíncrona
Consumo de créditos
ElevenLabs Dialogue — Tarea asíncrona
Modo de ejecución
Tarea asíncrona
Límite del prompt
5.000 caracteres
Límite de carga
No requiere archivos

Otros nombres

Un mismo modelo puede aparecer con nombres distintos según la fuente. Aquí los reunimos para facilitar la búsqueda y la comparación.

ElevenLabs Dialogue — ElevenLabs Dialogue V3 sirve para diálogos de pódcast
Eleven v3
Dialogue Mode

Preguntas frecuentes de los usuarios

Estas preguntas prácticas se centran en la tarea, las entradas y el resultado que conviene confirmar antes de elegir.

cómo usar ElevenLabs Dialogue V3
precio de ElevenLabs Dialogue V3
diálogo de varios personajes en ElevenLabs Dialogue V3
array dialogue de ElevenLabs Dialogue V3
ElevenLabs Dialogue V3 default_voice
diferencias entre ElevenLabs Dialogue V3 y Turbo 2.5
diferencias entre ElevenLabs Dialogue V3 y Multilingual V2
ElevenLabs Dialogue V3 sirve para diálogos de pódcast
ElevenLabs Dialogue V3 sirve para doblar minidramas
ElevenLabs Dialogue V3 14 créditos por 1.000 caracteres

Guía de elección

¿Aún no sabes qué modelo usar? Empieza por estos puntos clave.

1
Cuándo elegirlo primero

Incluye Dialogue V3 en una prueba corta si el guion contiene varios turnos y necesitas asignar una voz línea por línea. Valida primero los cambios de voz y la salida completa antes de ampliar la longitud.

2
Cuándo comparar primero otros modelos

Para una narración continua con una sola voz, compara primero las opciones de TTS individual. Tampoco es adecuado para agentes de voz interactivos, porque la información oficial indica que Text to Dialogue no es una aplicación en tiempo real.

3
Prueba mínima recomendada

Empieza con 2 voces y pocos turnos para comprobar la pronunciación, los cambios, los cortes, el formato de audio y el consumo real de créditos.

Comparaciones frecuentes

Compara alternativas habituales en la misma tarea para aclarar diferencias de entrada, control y coste.

¿Qué diferencias hay entre ElevenLabs Dialogue V3 y ElevenLabs Multilingual V2 y cuál conviene elegir?
ElevenLabs Dialogue V3 vs ElevenLabs Multilingual V2
diferencias entre ElevenLabs Dialogue V3 y ElevenLabs Turbo 2.5
ElevenLabs Dialogue V3 vs ElevenLabs Turbo 2.5

Tabla comparativa de modelos

¿No sabes cuál elegir? Esta tabla muestra de un vistazo las principales diferencias entre el modelo actual y sus alternativas.

Función actual en la plataforma
ElevenLabs Dialogue V3
Página de diálogos con guion y varios personajes
ElevenLabs Multilingual V2
Página de prueba de TTS multilingüe para una sola voz
ElevenLabs Turbo 2.5
Página comparativa de TTS para una sola voz con una tarifa más baja
Entrada principal actual
ElevenLabs Dialogue V3
`text + voice` en cada línea de `dialogue[]`
ElevenLabs Multilingual V2
Un bloque de texto + una sola voice
ElevenLabs Turbo 2.5
Un bloque de texto + una sola voice + marcas de tiempo / contexto
Precio actual
ElevenLabs Dialogue V3
14 créditos / 1.000 caracteres
ElevenLabs Multilingual V2
12 créditos / 1.000 caracteres
ElevenLabs Turbo 2.5
6 créditos / 1.000 caracteres
Tareas más adecuadas
ElevenLabs Dialogue V3
Diálogos de pódcast, minidramas y fragmentos interactivos con varias personas
ElevenLabs Multilingual V2
Narración con una sola voz y pruebas de pronunciación multilingüe
ElevenLabs Turbo 2.5
Muestras de TTS para una sola voz con una tarifa más baja

Experiencia de uso real

Orientación práctica basada en fuentes públicas, límites actuales del sitio y tareas representativas.

Es fácil describirlo por error como «un TTS más potente», pero no lo es

Presentarlo solo con el enfoque habitual de naturalidad, varios idiomas y baja latencia distorsionaría su función real.

Los diálogos con varios personajes deben evaluarse por el ritmo general y la diferenciación de las voces

Es habitual fijarse primero en si una frase suena humana, pero Dialogue V3 debe compararse por el ritmo, la diferenciación y la sensación dramática del intercambio entre varias personas. Estos aspectos reflejan mejor la utilidad real que el timbre de una sola frase.

Capacidades en detalle

ElevenLabs Dialogue: estructura de entrada clara

ElevenLabs Dialogue: estructura de entrada clara — Conoce los diálogos línea por línea, la selección de voces y el límite de 5.000 caracteres de ElevenLabs Dialogue V3 en Kyeo AI, además del precio real de 14 créditos por cada 1.000 caracteres.

La cantidad de voces y el código de idioma tienen límites independientes

La plataforma muestra 20 voces, pero la API oficial permite como máximo 10 valores únicos de `voice_id` por solicitud.

La facturación local solo cuenta los caracteres del diálogo

La plataforma suma el `length` de JavaScript del texto de cada línea de `dialogue[]` y redondea hacia arriba a razón de `14 / 1.000 caracteres`. La cantidad de voces, el código de idioma y los ajustes no se incluyen en la estimación.

Para qué sirve

Muestras de minidramas e interacción entre personajes

Conviene empezar con un diálogo de 15 a 30 segundos para evaluar la diferenciación y el ritmo de los turnos, en lugar de generar una historia larga desde el principio.

Conversación entre presentador e invitados de un pódcast

Adecuado para fragmentos de programas con dos o más personas que necesitan papeles definidos, timbres distintos y turnos claros.

Presentaciones de productos o contenido de marca con varios personajes

Adecuado para contenido de audio que necesita personalidad, interacción y límites más claros entre personajes.

Consejos para prompts

Una intervención por línea y personajes bien definidos

Lo más importante en esta página no es el estilo retórico, sino la estructura del guion. Define quién dice cada frase, dónde termina y quién interviene después.

Evalúa la diferenciación con una muestra corta

Con Dialogue V3 suele ser más fiable empezar con una muestra real de diálogo de 15 a 30 segundos que enviar directamente una historia larga completa.

La voice predeterminada es solo una alternativa, no el control principal

La voice de cada línea de `dialogue[]` es la que realmente determina el resultado. `default_voice` funciona como alternativa y no sustituye la asignación línea por línea.

Por qué elegirlo

La plataforma ofrece un flujo claro de diálogo con varios personajes mediante `dialogue[]`.
Cada línea puede tener una voice independiente, lo que resulta más adecuado para contenido interactivo con guion.
Un guion corto permite probar los cambios de voz, la pronunciación y la estructura de los turnos.
La estructura de entrada difiere del TTS para una sola voz, por lo que el límite de la tarea es fácil de reconocer.

Lo que debes saber antes de usarlo

No es una página convencional de narración con una sola voz ni un agente de voz en tiempo real.
La recomendación oficial es no superar 2.000 caracteres totales. Kyeo acepta hasta 5.000, pero conviene empezar con una longitud más conservadora para diálogos largos.
La API oficial admite un máximo de 10 voces distintas por solicitud, y Kyeo rechaza las solicitudes que superen esa cantidad antes de crear la tarea.
Antes de un uso final, comprueba con un guion representativo la diferenciación entre personajes, el ritmo, la pronunciación y la autorización de las voces.

Parámetros configurables

Te ayuda a evaluar rápidamente si este modelo encaja con tu caso de uso.

Voz predeterminada
default_voice
Opcional
Tipo de parámetro: select
Valor predeterminado: pNInz6obpgDQGcFmaJgB
Adam
Alice
Bill
Brian
Callum
Charlie
20 opciones
Estabilidad
stability
Opcional
Tipo de parámetro: select
Valor predeterminado: 0.5
0.0
0.5
1.0
Código de idioma
language_code
Opcional
Tipo de parámetro: text

Consumo de créditos

14 créditos / 1000 caracteres

Tarifa bruta de 14 créditos por 1000 caracteres; débito local Math.ceil(caracteres totales de dialogue[] × 14 / 1000), min=1 crédito.

Consejo para ahorrar

Antes de generar imágenes o videos por lotes, prueba el modelo actual y otras opciones similares con los mismos recursos. Cuando confirmes el resultado, inicia el lote para evitar gastar créditos de más.

Preguntas frecuentes

Modelos similares

¿Aún no te decides? Compara también estas alternativas similares.

ElevenLabs Multilingual V2

ElevenLabs Multilingual V2 es la página integrada actualmente en Kyeo AI para doblaje individual de alta naturalidad. Comparte un formulario similar con Turbo 2.5, pero los límites reales de las tareas son distintos: Turbo funciona como referencia para doblaje rápido, mientras que Multilingual V2 se orienta más a narraciones largas, contenido en varios idiomas y una voz de marca estable. En la plataforma también usa una lista fija de voces y un límite de 5.000 caracteres, pero la decisión se centra en la estabilidad percibida y en si compensa pagar el doble por carácter, no solo en la velocidad.

Modelo de audio con IA
12 créditos / 1000 caracteres

ElevenLabs Turbo 2.5

ElevenLabs Turbo 2.5 es el flujo de texto a voz individual que Kyeo mantiene actualmente. Permite elegir una voz de la plataforma y ajustar stability, similarity_boost, style, speed, timestamps, el contexto anterior y posterior y language_code. Todavía se pueden enviar tareas, pero ElevenLabs recomienda sustituirlo por Flash v2.5. La página no presenta la baja latencia, la compatibilidad de idiomas, la precisión de las marcas de tiempo, la autorización de las voces ni la calidad de salida como garantías de Kyeo.

Modelo de audio con IA
6 créditos / 1000 caracteres

Suno Music

Suno Music es la entrada de Kyeo AI para generar música a partir de texto. El formulario actual solo ofrece el prompt, la versión y el selector de música instrumental. Tras una generación correcta, los resultados que cumplan los requisitos se pueden extender, convertir a WAV o separar en pistas vocales. La página no incluye controles del producto oficial como letra, título, peso del estilo, Persona, Voices, Custom Models o My Taste.

Modelo de audio con IA
Generación / extensión: 12 créditos por tarea

Fuentes de información

El contenido de esta página reúne documentación del modelo, descripciones de funciones y la configuración disponible actualmente en Kyeo AI.

Nota sobre las fuentes

Conoce los diálogos línea por línea, la selección de voces y el límite de 5.000 caracteres de ElevenLabs Dialogue V3 en Kyeo AI, además del precio real de 14 créditos por cada 1.000 caracteres. Tarifa bruta de 14 créditos por 1000 caracteres; débito local Math.ceil(caracteres totales de dialogue[] × 14 / 1000), min=1 crédito.

Última actualización: 2026-07-20
ElevenLabs Help: What is Eleven v3?
Oficial
Ver fuente original
ElevenLabs Help: What is Dialogue mode?
Oficial
Ver fuente original
ElevenLabs Docs: Models
Oficial
Ver fuente original
ElevenLabs Docs: Text to Dialogue
Oficial
Ver fuente original
ElevenLabs API: Create dialogue
Oficial
Ver fuente original