Ir para o conteúdo principal

Modelos de áudio com IA

Experimente modelos populares para voz, texto para fala e geração de efeitos sonoros · 6 modelos disponíveis no momento · 4 modelos disponíveis apenas para consulta

Compare modelos para texto em voz, locução, diálogos com várias vozes, rascunhos musicais e efeitos sonoros.

Suno Music é a ferramenta de texto para música da Kyeo AI. O formulário atual oferece apenas prompt, versão e modo instrumental; após uma geração bem-sucedida, resultados elegíveis podem ser estendidos, convertidos para WAV ou ter os vocais separados. A página não oferece controles do produto oficial, como letra, título, peso de estilo, Persona, Voices, Custom Models ou My Taste.

Texto para áudio

Suno Sounds é a ferramenta de texto para áudio da Kyeo AI. Ela permite escolher V5 ou V5.5, orientar o resultado para one-shot ou loop e, opcionalmente, definir BPM de 1 a 300 e Key. Os recursos Beta, a quantidade de amostras e os direitos de assinatura do produto oficial não se aplicam automaticamente aos resultados da plataforma.

Texto para áudio

Suno Lyrics é a ferramenta de texto para letras da Kyeo AI. Insira um tema ou pedido de até 200 caracteres e, quando a tarefa terminar, veja o título e a letra interpretados na resposta.

Escrever letras
Criar rascunhos de letras

ElevenLabs Dialogue V3 gera diálogos linha por linha: você insere a fala e escolhe a voz de cada linha, e a Kyeo AI cobra pelo total de caracteres das falas. Não é um agente de voz em tempo real, e a documentação oficial alerta que várias gerações podem ser necessárias para encontrar um resultado aproveitável. Recomendamos testar antes as trocas de personagem, as marcações de emoção, o código do idioma, o formato de saída e a integridade de roteiros longos.

Diálogo para áudio

ElevenLabs Turbo 2.5 é o fluxo de texto para fala com uma voz que a Kyeo mantém disponível. É possível escolher uma voz da plataforma e ajustar stability, similarity_boost, style, speed, timestamps, contexto anterior e posterior e language_code. O envio continua disponível, mas a ElevenLabs atualmente recomenda substituí-lo pelo Flash v2.5. A página não apresenta baixa latência, idiomas aceitos, precisão dos timestamps, autorização da voz nem qualidade da saída como garantias da Kyeo.

Texto para fala

ElevenLabs Multilingual V2 é a ferramenta atual da Kyeo AI para fala mais natural com uma voz. Ela usa um formulário semelhante ao Turbo 2.5, mas atende a outro objetivo: Turbo funciona como referência de locução rápida, enquanto Multilingual V2 é voltado a narrações longas, conteúdo em vários idiomas e manutenção de uma voz de marca. A integração também usa uma lista fixa de vozes e aceita até 5.000 caracteres, mas a decisão passa da velocidade para a estabilidade sonora e para saber se vale pagar o dobro por caractere.

Texto para fala
Indisponível no momento

ElevenLabs Sound Effect V2 foi criado para produzir efeitos sonoros a partir de descrições em texto, mas não está disponível no site no momento. A página não inicia gerações, não cria tarefas e não desconta pontos.

As informações completas foram preservadas, mas a geração online não está disponível.

Texto para áudio
Indisponível no momento

ElevenLabs Audio Isolation está relacionado a limpeza de áudio que separa a fala do ruído de fundo. A geração permanece fechada, sem criar tarefas ou cobrar créditos. Esta página mantém o contexto verificado e indica alternativas ativas.

As informações completas foram preservadas, mas a geração online não está disponível.

Limpar gravação
Isolar voz
Indisponível no momento

O Gemini 3.1 Flash TTS já tem um contrato confirmado para diálogos com vários locutores e controles de voz. Como não é possível demonstrar o consumo máximo possível de áudio antes da criação, esta página permanece indexável, mas a geração está desativada.

As informações completas foram preservadas, mas a geração online não está disponível.

Texto para fala
dialogue-to-speech
Indisponível no momento

O Gemini 2.5 Pro TTS é voltado a um desenho de voz mais detalhado para vários personagens. Como ainda não há um limite para o consumo de áudio na saída, esta página oferece apenas informações públicas e indexáveis sobre o contrato e caminhos alternativos.

As informações completas foram preservadas, mas a geração online não está disponível.

Texto para fala
dialogue-to-speech