Model Audio AI
Coba model audio populer untuk sulih suara AI, teks ke suara, dan pembuatan efek suara · Saat ini tersedia 6 model · 4 model hanya untuk referensi
Bandingkan model untuk teks-ke-suara, sulih suara, dialog multi-pembicara, draf musik, dan efek suara.
Suno Music adalah titik masuk Kyeo AI untuk membuat musik dari teks. Formulir saat ini hanya menyediakan prompt, versi, dan opsi instrumental. Setelah pembuatan berhasil, hasil yang memenuhi syarat dapat di-extend, dikonversi ke WAV, atau dipisahkan vokalnya. Halaman ini tidak menyediakan kontrol produk resmi seperti lirik, judul, bobot gaya, Persona, Voices, Custom Models, atau My Taste.
Suno Sounds adalah titik masuk Kyeo AI untuk membuat suara dari teks. Anda dapat memilih V5 atau V5.5, arah one-shot atau loop, serta mengatur BPM 1–300 dan Key secara opsional. Fitur Beta, jumlah sampel, dan hak langganan di produk resmi tidak otomatis berlaku pada hasil di situs.
Suno Lyrics adalah titik masuk Kyeo AI untuk membuat lirik dari teks. Masukkan tema atau permintaan hingga 200 karakter, lalu lihat judul dan teks lirik yang berhasil diuraikan setelah tugas selesai.
ElevenLabs Dialogue V3 saat ini membuat dialog per baris: isi dialog dan pilih suara untuk setiap baris, lalu Kyeo AI mengenakan biaya berdasarkan jumlah karakter seluruh dialog. Ini bukan agen suara real-time; materi resmi juga menyatakan bahwa beberapa kali pembuatan mungkin diperlukan untuk memperoleh hasil yang dapat digunakan. Uji sampel terlebih dahulu untuk memastikan pergantian peran, tag emosi, kode bahasa, format keluaran, dan kelengkapan skrip panjang.
ElevenLabs Turbo 2.5 adalah alur teks ke suara satu pembicara yang masih dipertahankan Kyeo. Anda dapat memilih suara di situs dan menyesuaikan stability, similarity_boost, style, speed, timestamps, konteks sebelum dan sesudah, serta language_code. Tugas masih dapat dikirim, tetapi ElevenLabs kini menyarankan Flash v2.5 sebagai penggantinya. Halaman ini tidak menjadikan latensi rendah, dukungan bahasa, akurasi timestamp, izin suara, atau kualitas keluaran sebagai jaminan Kyeo.
ElevenLabs Multilingual V2 adalah halaman sulih suara satu pembicara dengan naturalitas tinggi yang saat ini terintegrasi di Kyeo AI. Formulirnya mirip dengan Turbo 2.5, tetapi batas tugasnya berbeda: Turbo lebih berfungsi sebagai patokan sulih suara cepat, sedangkan Multilingual V2 lebih ditujukan untuk narasi panjang, konten lintas bahasa, dan suara merek jangka panjang. Di situs, model ini tetap memakai daftar peran suara tetap dan batas 5,000 karakter; keputusan utamanya bergeser dari kecepatan ke kestabilan hasil dengar dan apakah biaya per karakter yang dua kali lipat layak dibayar.
ElevenLabs Sound Effect V2 dirancang untuk membuat efek suara dari deskripsi teks, tetapi saat ini belum dapat digunakan di situs. Halaman tidak memulai pembuatan, membuat tugas, atau memotong poin.
Informasi lengkap model tetap tersedia, tetapi pembuatan online belum didukung.
ElevenLabs Audio Isolation berkaitan dengan pembersihan audio yang memisahkan ucapan dari kebisingan latar. Pembuatan saat ini ditutup sehingga tidak ada tugas atau pemotongan kredit. Halaman ini menyimpan konteks terverifikasi dan menunjukkan alternatif aktif.
Informasi lengkap model tetap tersedia, tetapi pembuatan online belum didukung.
Gemini 3.1 Flash TTS telah memiliki kontrak untuk dialog banyak pembicara dan kontrol suara. Namun, penggunaan audio keluaran dalam skenario terburuk belum dapat dibuktikan sebelum pembuatan, sehingga saat ini hanya halaman detail yang dapat diindeks yang dipertahankan.
Informasi lengkap model tetap tersedia, tetapi pembuatan online belum didukung.
Gemini 2.5 Pro TTS ditujukan untuk perancangan suara multikarakter yang lebih terperinci. Karena batas penggunaan audio keluaran belum tersedia, saat ini hanya informasi kontrak yang dapat diindeks dan jalur alternatif yang dipublikasikan.
Informasi lengkap model tetap tersedia, tetapi pembuatan online belum didukung.