โมเดลเสียง AI
ทดลองโมเดลเสียงยอดนิยมออนไลน์สำหรับพากย์เสียง AI ข้อความเป็นเสียง และสร้างเอฟเฟกต์เสียง · ขณะนี้มีโมเดลพร้อมใช้ทั้งหมด 6 โมเดล · 4 โมเดลมีไว้ดูข้อมูลเท่านั้น
เปรียบเทียบโมเดลแปลงข้อความเป็นเสียง พากย์เสียง บทสนทนาหลายเสียง ร่างเพลง และเอฟเฟกต์เสียง
Suno Music คือช่องทางสร้างเพลงจากข้อความบน Kyeo AI แบบฟอร์มปัจจุบันมีเพียงพรอมต์ รุ่น และสวิตช์เพลงบรรเลง เมื่อสร้างสำเร็จ ผลลัพธ์ที่เข้าเงื่อนไขสามารถนำไปต่อความยาว แปลงเป็น WAV หรือแยกเสียงร้องได้ หน้านี้ไม่มีตัวเลือกจากผลิตภัณฑ์ทางการ เช่น เนื้อเพลง ชื่อเพลง น้ำหนักสไตล์ Persona, Voices, Custom Models หรือ My Taste
Suno Sounds คือช่องทางสร้างเสียงจากข้อความบน Kyeo AI เลือก V5 หรือ V5.5 กำหนดแนวทางแบบ one-shot หรือวนซ้ำ และเลือกตั้ง BPM ระหว่าง 1–300 กับ Key ได้ ฟังก์ชัน Beta จำนวนตัวอย่าง และสิทธิ์จากการสมัครบนเว็บไซต์ทางการไม่ได้เท่ากับผลลัพธ์บนเว็บไซต์นี้โดยอัตโนมัติ
Suno Lyrics คือช่องทางสร้างเนื้อเพลงจากข้อความบน Kyeo AI ใส่หัวข้อหรือข้อกำหนดไม่เกิน 200 ตัวอักษร แล้วดูชื่อเรื่องและข้อความเนื้อเพลงที่แยกได้หลังงานเสร็จ
ElevenLabs Dialogue V3 ปัจจุบันสร้างบทสนทนาทีละบรรทัด โดยใส่บทพูดและเลือกเสียงในแต่ละบรรทัด ส่วน Kyeo AI คิดค่าบริการตามจำนวนตัวอักษรรวมของบทพูด ไม่ใช่ตัวแทนเสียงแบบเรียลไทม์ และข้อมูลทางการยังระบุว่าอาจต้องสร้างหลายครั้งจึงจะเลือกผลลัพธ์ที่ใช้ได้ หน้านี้แนะนำให้ใช้ตัวอย่างตรวจสอบการสลับตัวละคร ป้ายอารมณ์ รหัสภาษา รูปแบบเอาต์พุต หรือความครบถ้วนของสคริปต์ยาวก่อน
ElevenLabs Turbo 2.5 คือขั้นตอนข้อความเป็นเสียงพูดสำหรับผู้พูดคนเดียวที่ Kyeo ยังเปิดไว้ปัจจุบัน เลือกเสียงบนเว็บไซต์และปรับ stability, similarity_boost, style, speed, timestamps, บริบทก่อนและหลัง รวมถึง language_code ได้ แม้ยังส่งงานได้ แต่ ElevenLabs แนะนำให้ใช้ Flash v2.5 แทนแล้ว หน้านี้ไม่ถือว่าความหน่วงต่ำ การรองรับภาษา ความแม่นยำของ timestamp สิทธิ์ของเสียง หรือคุณภาพเอาต์พุตเป็นสิ่งที่ Kyeo รับประกัน
ElevenLabs Multilingual V2 คือหน้าพากย์เสียงผู้พูดคนเดียวที่เน้นความเป็นธรรมชาติสูงซึ่ง Kyeo AI เชื่อมต่ออยู่ปัจจุบัน แม้ใช้แบบฟอร์มคล้าย Turbo 2.5 แต่ขอบเขตงานต่างกันจริง: Turbo เป็นพื้นฐานพากย์เสียงเร็ว ส่วน Multilingual V2 เหมาะเป็นตัวหลักสำหรับเสียงบรรยายยาว คอนเทนต์ข้ามภาษา และน้ำเสียงแบรนด์ระยะยาว ปัจจุบันยังใช้รายการตัวละครเสียงแบบตายตัวและช่องทาง 5,000 ตัวอักษรเหมือนกัน แต่การตัดสินใจเปลี่ยนจากความเร็วมาเป็นความคงที่ของเสียงและความคุ้มค่าของต้นทุนต่อตัวอักษรที่สูงเป็นสองเท่า
ElevenLabs Sound Effect V2 ออกแบบมาเพื่อสร้างเอฟเฟกต์เสียงจากคำบรรยาย แต่ขณะนี้ยังใช้งานบนเว็บไซต์ไม่ได้ หน้านี้จะไม่เริ่มสร้างเสียง ไม่สร้างงาน และไม่หักคะแนน
เก็บข้อมูลโมเดลฉบับเต็มไว้แล้ว แต่ขณะนี้ยังสร้างออนไลน์ไม่ได้
ElevenLabs Audio Isolation เกี่ยวข้องกับการทำความสะอาดเสียงด้วยการแยกคำพูดออกจากเสียงรบกวนพื้นหลัง ขณะนี้ปิดการสร้าง จึงไม่มีการสร้างงานหรือหักเครดิต หน้านี้เก็บบริบทที่ตรวจสอบแล้วและแนะนำทางเลือกที่เปิดใช้งาน
เก็บข้อมูลโมเดลฉบับเต็มไว้แล้ว แต่ขณะนี้ยังสร้างออนไลน์ไม่ได้
Gemini 3.1 Flash TTS มีข้อกำหนดบทสนทนาหลายผู้พูดและการควบคุมเสียงที่ยืนยันแล้ว แต่ยังพิสูจน์การใช้เสียงขาออกในกรณีสูงสุดก่อนสร้างงานไม่ได้ จึงคงไว้เฉพาะหน้ารายละเอียดที่จัดทำดัชนีได้
เก็บข้อมูลโมเดลฉบับเต็มไว้แล้ว แต่ขณะนี้ยังสร้างออนไลน์ไม่ได้
Gemini 2.5 Pro TTS มุ่งเน้นการออกแบบเสียงหลายตัวละครที่ละเอียดขึ้น แต่ยังไม่มีเพดานการใช้เสียงขาออก จึงเผยแพร่เฉพาะข้อมูลข้อกำหนดที่จัดทำดัชนีได้และเส้นทางทางเลือก
เก็บข้อมูลโมเดลฉบับเต็มไว้แล้ว แต่ขณะนี้ยังสร้างออนไลน์ไม่ได้