ElevenLabs Dialogue V3
ElevenLabs Dialogue V3 genera actualmente diálogos línea por línea: en cada línea se escribe el texto y se elige una voz, y Kyeo AI factura según el total de caracteres del diálogo. No es un agente de voz en tiempo real; la información oficial también advierte que puede ser necesario generar varias veces para encontrar un resultado útil. Recomendamos empezar con una muestra para comprobar los cambios de personaje, las etiquetas de emoción, el código de idioma, el formato de salida y la integridad de guiones largos.
En pocas palabras
¿Qué ofrece este modelo?
La plataforma ofrece 20 voces, aplica un límite total de 5.000 caracteres a todas las líneas y restringe cada solicitud a un máximo de 10 voces distintas. Los controles de formato de salida, seed, normalización de texto y diccionario de pronunciación aún no están disponibles. Valida primero un guion corto antes de usarlo en un trabajo final.
Parámetros principales
Te ayuda a evaluar rápidamente si este modelo encaja con tu caso de uso.
Otros nombres
Un mismo modelo puede aparecer con nombres distintos según la fuente. Aquí los reunimos para facilitar la búsqueda y la comparación.
Preguntas frecuentes de los usuarios
Estas preguntas prácticas se centran en la tarea, las entradas y el resultado que conviene confirmar antes de elegir.
Guía de elección
¿Aún no sabes qué modelo usar? Empieza por estos puntos clave.
Incluye Dialogue V3 en una prueba corta si el guion contiene varios turnos y necesitas asignar una voz línea por línea. Valida primero los cambios de voz y la salida completa antes de ampliar la longitud.
Para una narración continua con una sola voz, compara primero las opciones de TTS individual. Tampoco es adecuado para agentes de voz interactivos, porque la información oficial indica que Text to Dialogue no es una aplicación en tiempo real.
Empieza con 2 voces y pocos turnos para comprobar la pronunciación, los cambios, los cortes, el formato de audio y el consumo real de créditos.
Comparaciones frecuentes
Compara alternativas habituales en la misma tarea para aclarar diferencias de entrada, control y coste.
Tabla comparativa de modelos
¿No sabes cuál elegir? Esta tabla muestra de un vistazo las principales diferencias entre el modelo actual y sus alternativas.
Experiencia de uso real
Orientación práctica basada en fuentes públicas, límites actuales del sitio y tareas representativas.
Es fácil describirlo por error como «un TTS más potente», pero no lo es
Los diálogos con varios personajes deben evaluarse por el ritmo general y la diferenciación de las voces
Capacidades en detalle
ElevenLabs Dialogue: estructura de entrada clara
La cantidad de voces y el código de idioma tienen límites independientes
La facturación local solo cuenta los caracteres del diálogo
Para qué sirve
Muestras de minidramas e interacción entre personajes
Conversación entre presentador e invitados de un pódcast
Presentaciones de productos o contenido de marca con varios personajes
Consejos para prompts
Una intervención por línea y personajes bien definidos
Evalúa la diferenciación con una muestra corta
La voice predeterminada es solo una alternativa, no el control principal
Por qué elegirlo
Lo que debes saber antes de usarlo
Parámetros configurables
Te ayuda a evaluar rápidamente si este modelo encaja con tu caso de uso.
Consumo de créditos
Tarifa bruta de 14 créditos por 1000 caracteres; débito local Math.ceil(caracteres totales de dialogue[] × 14 / 1000), min=1 crédito.
Antes de generar imágenes o videos por lotes, prueba el modelo actual y otras opciones similares con los mismos recursos. Cuando confirmes el resultado, inicia el lote para evitar gastar créditos de más.
Preguntas frecuentes
Modelos similares
¿Aún no te decides? Compara también estas alternativas similares.
ElevenLabs Multilingual V2
ElevenLabs Multilingual V2 es la página integrada actualmente en Kyeo AI para doblaje individual de alta naturalidad. Comparte un formulario similar con Turbo 2.5, pero los límites reales de las tareas son distintos: Turbo funciona como referencia para doblaje rápido, mientras que Multilingual V2 se orienta más a narraciones largas, contenido en varios idiomas y una voz de marca estable. En la plataforma también usa una lista fija de voces y un límite de 5.000 caracteres, pero la decisión se centra en la estabilidad percibida y en si compensa pagar el doble por carácter, no solo en la velocidad.
ElevenLabs Turbo 2.5
ElevenLabs Turbo 2.5 es el flujo de texto a voz individual que Kyeo mantiene actualmente. Permite elegir una voz de la plataforma y ajustar stability, similarity_boost, style, speed, timestamps, el contexto anterior y posterior y language_code. Todavía se pueden enviar tareas, pero ElevenLabs recomienda sustituirlo por Flash v2.5. La página no presenta la baja latencia, la compatibilidad de idiomas, la precisión de las marcas de tiempo, la autorización de las voces ni la calidad de salida como garantías de Kyeo.
Suno Music
Suno Music es la entrada de Kyeo AI para generar música a partir de texto. El formulario actual solo ofrece el prompt, la versión y el selector de música instrumental. Tras una generación correcta, los resultados que cumplan los requisitos se pueden extender, convertir a WAV o separar en pistas vocales. La página no incluye controles del producto oficial como letra, título, peso del estilo, Persona, Voices, Custom Models o My Taste.
Fuentes de información
El contenido de esta página reúne documentación del modelo, descripciones de funciones y la configuración disponible actualmente en Kyeo AI.
Conoce los diálogos línea por línea, la selección de voces y el límite de 5.000 caracteres de ElevenLabs Dialogue V3 en Kyeo AI, además del precio real de 14 créditos por cada 1.000 caracteres. Tarifa bruta de 14 créditos por 1000 caracteres; débito local Math.ceil(caracteres totales de dialogue[] × 14 / 1000), min=1 crédito.