Gemini 3.1 Flash TTS
Gemini 3.1 Flash TTS tiene funciones confirmadas para diálogos con varios hablantes y control de voz, pero el consumo máximo de audio no puede demostrarse antes de crear una tarea; por ahora solo se mantiene su ficha informativa.
No disponible para uso en línea por el momento
Esta página solo permite consultar las capacidades, los casos de uso y la información pública del modelo. No aparecerá en el espacio de trabajo de la página de inicio ni permitirá enviar tareas de generación.
En pocas palabras
¿Qué ofrece este modelo?
No es un modelo Coming Soon ni ha sido retirado. La limitación procede del margen de seguridad de la preautorización: los conjuntos de hablantes y diálogos no tienen un límite total, y tampoco existe un máximo demostrable que relacione el texto con los tokens de audio de salida. Por ello, el modelo no aparece en el selector y todas las solicitudes se rechazan antes de descontar créditos.
Parámetros principales
Te ayuda a evaluar rápidamente si este modelo encaja con tu caso de uso.
Otros nombres
Un mismo modelo puede aparecer con nombres distintos según la fuente. Aquí los reunimos para facilitar la búsqueda y la comparación.
Preguntas frecuentes de los usuarios
Estas preguntas prácticas se centran en la tarea, las entradas y el resultado que conviene confirmar antes de elegir.
Guía de elección
¿Aún no sabes qué modelo usar? Empieza por estos puntos clave.
Utiliza primero ElevenLabs Dialogue V3 y prueba la separación de personajes con un guion breve.
Compara primero ElevenLabs Turbo 2.5 y Multilingual V2.
Guarda tres guiones no sensibles: narración, entrevista a dos voces y escena breve con personajes.
Comparaciones frecuentes
Compara alternativas habituales en la misma tarea para aclarar diferencias de entrada, control y coste.
Tabla comparativa de modelos
¿No sabes cuál elegir? Esta tabla muestra de un vistazo las principales diferencias entre el modelo actual y sus alternativas.
Experiencia de uso real
Orientación práctica basada en fuentes públicas, límites actuales del sitio y tareas representativas.
La baja latencia no sustituye un límite de coste
Las entradas multihablante amplían el peor caso
Capacidades en detalle
Configuración multihablante
Diálogo ordenado
Control de voz
Para qué sirve
Planificación de podcasts
Preparación de escenas con personajes
Evaluación futura con el mismo guion
Consejos para prompts
Mantén constantes los identificadores
Valida primero con un guion breve
No deduzcas la duración de salida
Por qué elegirlo
Lo que debes saber antes de usarlo
No disponible actualmente
Esta página solo permite consultar las capacidades, los casos de uso y la información pública del modelo. No aparecerá en el espacio de trabajo de la página de inicio ni permitirá enviar tareas de generación. Candidato de Gemini TTS orientado a generar voz con rapidez y controlar diálogos con varios personajes.
Preguntas frecuentes
Modelos similares
¿Aún no te decides? Compara también estas alternativas similares.
ElevenLabs Dialogue V3
ElevenLabs Dialogue V3 genera actualmente diálogos línea por línea: en cada línea se escribe el texto y se elige una voz, y Kyeo AI factura según el total de caracteres del diálogo. No es un agente de voz en tiempo real; la información oficial también advierte que puede ser necesario generar varias veces para encontrar un resultado útil. Recomendamos empezar con una muestra para comprobar los cambios de personaje, las etiquetas de emoción, el código de idioma, el formato de salida y la integridad de guiones largos.
ElevenLabs Turbo 2.5
ElevenLabs Turbo 2.5 es el flujo de texto a voz individual que Kyeo mantiene actualmente. Permite elegir una voz de la plataforma y ajustar stability, similarity_boost, style, speed, timestamps, el contexto anterior y posterior y language_code. Todavía se pueden enviar tareas, pero ElevenLabs recomienda sustituirlo por Flash v2.5. La página no presenta la baja latencia, la compatibilidad de idiomas, la precisión de las marcas de tiempo, la autorización de las voces ni la calidad de salida como garantías de Kyeo.
ElevenLabs Multilingual V2
ElevenLabs Multilingual V2 es la página integrada actualmente en Kyeo AI para doblaje individual de alta naturalidad. Comparte un formulario similar con Turbo 2.5, pero los límites reales de las tareas son distintos: Turbo funciona como referencia para doblaje rápido, mientras que Multilingual V2 se orienta más a narraciones largas, contenido en varios idiomas y una voz de marca estable. En la plataforma también usa una lista fija de voces y un límite de 5.000 caracteres, pero la decisión se centra en la estabilidad percibida y en si compensa pagar el doble por carácter, no solo en la velocidad.
Fuentes de información
El contenido de esta página reúne documentación del modelo, descripciones de funciones y la configuración disponible actualmente en Kyeo AI.
Se han confirmado los controles de hablantes, diálogos y voz de Gemini 3.1 Flash TTS, así como sus tarifas por token. Sin embargo, no es posible demostrar antes de crear la solicitud el límite máximo de tokens de audio de salida, por lo que la generación permanece desactivada en este sitio.