ข้ามไปยังเนื้อหาหลัก
โมเดลเสียง AI
Google
Gemini TTS

Gemini 3.1 Flash TTS

Gemini 3.1 Flash TTS มีข้อกำหนดบทสนทนาหลายผู้พูดและการควบคุมเสียงที่ยืนยันแล้ว แต่ยังพิสูจน์การใช้เสียงขาออกในกรณีสูงสุดก่อนสร้างงานไม่ได้ จึงคงไว้เฉพาะหน้ารายละเอียดที่จัดทำดัชนีได้

ยังใช้งานออนไลน์ไม่ได้

หน้านี้มีไว้สำหรับดูความสามารถ กรณีใช้งาน และข้อมูลสาธารณะของโมเดลเท่านั้น โมเดลนี้จะไม่แสดงในพื้นที่ทำงานหน้าหลักและส่งงานสร้างไม่ได้

สถานะปัจจุบัน
ติดขัดที่การกันวงเงิน
รูปแบบอินพุต
ผู้พูด + บทสนทนาตามลำดับ
ขอบเขตการเรียกใช้
ไม่สร้างงานและไม่หักเครดิต
ไม่ใช่ Coming Soon แต่เงื่อนไขการกันวงเงินยังไม่ครบถ้วน
ยืนยันฟิลด์ผู้พูดหลายคน ลำดับบทสนทนา สำเนียง สไตล์ และจังหวะแล้ว
ไม่อยู่ในตัวเลือก ไม่สร้างงาน และไม่หักเครดิต
เข้าใจใน 30 วินาที
Gemini TTS
ยังใช้ไม่ได้
ถนัดด้านใด
ตัวเลือก Gemini TTS สำหรับการสร้างเสียงที่รวดเร็วและการควบคุมบทสนทนาหลายตัวละคร
เหมาะกับใคร
ผู้ที่ติดตามแนวโน้มบทสนทนาพอดแคสต์ เสียงบรรยาย และเสียงตัวละคร และต้องการเตรียมสคริปต์ประเมินไว้ล่วงหน้า
คำค้นหายอดนิยม
Gemini 3.1 Flash TTS ใช้ได้หรือยังGemini 3.1 Flash TTS พากย์หลายผู้พูดราคา Gemini 3.1 Flash TTS

สรุปในประโยคเดียว

โมเดลนี้เป็นอย่างไร?

นี่ไม่ใช่สถานะ Coming Soon และไม่ใช่โมเดลที่ยุติให้บริการ ข้อจำกัดปัจจุบันมาจากขอบเขตความปลอดภัยในการกันวงเงินของเว็บไซต์: อาร์เรย์ผู้พูดและบทสนทนาไม่มีขีดจำกัดรวม และยังไม่มีเพดานกรณีสูงสุดที่พิสูจน์ได้จากข้อความไปยัง token เสียงขาออก โมเดลจึงไม่ปรากฏในตัวเลือก และทุกคำขอจะถูกปฏิเสธก่อนหักเครดิต

ถนัดด้านใด
ตัวเลือก Gemini TTS สำหรับการสร้างเสียงที่รวดเร็วและการควบคุมบทสนทนาหลายตัวละคร
เหมาะกับใคร
ผู้ที่ติดตามแนวโน้มบทสนทนาพอดแคสต์ เสียงบรรยาย และเสียงตัวละคร และต้องการเตรียมสคริปต์ประเมินไว้ล่วงหน้า
ทำไมจึงใช้บน Kyeo AI
หน้าเว็บเผยแพร่ความสามารถที่ยืนยันแล้วและเหตุผลที่ถูกระงับก่อน; โมเดลจะยังไม่เข้าสู่พื้นที่ทำงานหรืออินเทอร์เฟซเรียกใช้จนกว่าเพดานการกันวงเงินจะครบถ้วน

พารามิเตอร์สำคัญ

ช่วยให้ประเมินได้รวดเร็วว่าโมเดลนี้เหมาะกับกรณีใช้งานทางธุรกิจของคุณหรือไม่

ผู้พัฒนา
Google
ตระกูลโมเดล
Gemini TTS
อินพุตที่ยืนยันแล้ว
การตั้งค่าผู้พูดและบทสนทนาตามลำดับ
ข้อความต่อช่วง
ไม่เกิน 10,000 อักขระ
ข้อมูลที่ยังขาด
เพดานสูงสุดของ token เสียงขาออก

ชื่อเรียกอื่น

โมเดลเดียวกันอาจมีชื่อเรียกต่างกันในแหล่งข้อมูลแต่ละแห่ง ส่วนนี้รวบรวมไว้เพื่อให้ค้นหาและเปรียบเทียบได้ง่าย

Gemini Flash TTS
Gemini 3.1 Text to Speech

คำถามที่พบบ่อยของผู้ใช้

คำถามเชิงปฏิบัติเหล่านี้เน้นงาน เงื่อนไขอินพุต และผลลัพธ์ที่ควรยืนยันก่อนเลือก

Gemini 3.1 Flash TTS ใช้ได้หรือยัง
Gemini 3.1 Flash TTS พากย์หลายผู้พูด
ราคา Gemini 3.1 Flash TTS
วิธีใช้ Gemini TTS
โมเดลทางเลือก Gemini TTS

คู่มือเลือกโมเดล

ยังไม่แน่ใจว่าจะใช้โมเดลใด? ลองดูปัจจัยสำคัญเหล่านี้ก่อน

1
ต้องสร้างบทสนทนาหลายผู้พูดตอนนี้

ใช้ ElevenLabs Dialogue V3 ก่อน แล้วทดสอบการแยกตัวละครด้วยสคริปต์สั้น

2
ต้องพากย์เสียงผู้พูดคนเดียวอย่างรวดเร็วตอนนี้

เปรียบเทียบ ElevenLabs Turbo 2.5 กับ Multilingual V2 ก่อน

3
เตรียมการทดสอบในอนาคต

เก็บสคริปต์ที่ไม่มีข้อมูลละเอียดอ่อนไว้สามแบบ: เสียงบรรยาย บทสัมภาษณ์สองคน และฉากสั้นของตัวละคร

คำเปรียบเทียบที่ค้นหาบ่อย

เปรียบเทียบตัวเลือกที่พบบ่อยในงานเดียวกัน เพื่อดูความต่างด้านอินพุต การควบคุม และค่าใช้จ่าย

Gemini 3.1 Flash TTS เทียบกับ ElevenLabs Dialogue V3
ทำไม Gemini 3.1 Flash TTS จึงยังสร้างไม่ได้
Gemini 3.1 Flash TTS ควบคุมเสียงอะไรได้บ้าง

ตารางเปรียบเทียบโมเดล

ยังเลือกไม่ได้? ตารางนี้สรุปความแตกต่างหลักระหว่างโมเดลนี้กับตัวเลือกอื่นให้ดูได้ทันที

ประสบการณ์ใช้งานจริง

คำแนะนำเชิงปฏิบัติจากแหล่งข้อมูลสาธารณะ ขอบเขตปัจจุบันของเว็บไซต์ และงานตัวอย่างที่พบได้ทั่วไป

ความหน่วงต่ำไม่ใช่เพดานค่าใช้จ่าย

แม้โมเดลจะเน้นความเร็ว แต่หากไม่มีจำนวน token เสียงขาออกสูงสุด ก็ไม่อาจรับประกันว่าการกันวงเงินจะครอบคลุมค่าใช้จ่าย

อินพุตหลายตัวละครเพิ่มการใช้งานกรณีสูงสุด

เมื่อจำนวนรวมของอาร์เรย์ไม่ถูกจำกัด เพดาน 10,000 อักขระต่อช่วงจึงไม่ใช่ขีดจำกัดของคำขอทั้งหมด

รายละเอียดความสามารถ

การตั้งค่าผู้พูดหลายคน

ข้อกำหนดระบุให้ตั้งรหัส เสียง และสำเนียงสำหรับผู้พูดแต่ละคน

บทสนทนาตามลำดับ

บทสนทนาถูกสร้างตามลำดับ และข้อความแต่ละช่วงผูกกับผู้พูดที่ประกาศไว้

การควบคุมเสียง

สามารถอธิบายฉาก น้ำเสียงโดยรวม โปรไฟล์เสียง สไตล์ และจังหวะได้

เหมาะกับงานใด

วางแผนบทสนทนาพอดแคสต์

เตรียมสคริปต์แยกบทบาทสำหรับผู้ดำเนินรายการและแขกรับเชิญ

เตรียมฉากสั้นของตัวละคร

วางแผนบทสนทนาตามลำดับและจังหวะอารมณ์ของหลายตัวละคร

ประเมินด้วยโจทย์เดียวกันในอนาคต

เมื่อเปิดให้ใช้แล้ว ให้เปรียบเทียบการแยกเสียง ความหน่วง และเครดิตที่ใช้จริง

เคล็ดลับการเขียนพรอมต์

ใช้รหัสผู้พูดให้สม่ำเสมอ

บทสนทนาแต่ละช่วงต้องอ้างถึงผู้พูดที่ประกาศไว้แล้ว

ทดสอบด้วยสคริปต์สั้นก่อน

ตรวจชื่อเฉพาะ การเว้นจังหวะ และการแยกตัวละครก่อนเพิ่มความยาวข้อความ

อย่าคาดเดาความยาวเสียงขาออก

ความยาวข้อความเพียงอย่างเดียวพิสูจน์จำนวน token เสียงสูงสุดไม่ได้

เหตุผลที่ควรเลือก

ฟิลด์ผู้พูด บทสนทนา และการควบคุมเสียงมีข้อกำหนดชัดเจน
รองรับความตั้งใจค้นหาทั้งเสียงบรรยายคนเดียวและบทสนทนาหลายตัวละคร
แยกข้อมูลรายละเอียดออกจากการเรียกใช้จริงอย่างเคร่งครัด

สิ่งที่ควรรู้ก่อนใช้

ขณะนี้สร้างงานเสียงหรือหักเครดิตไม่ได้
แม้บทสนทนาแต่ละช่วงจำกัดที่ 10,000 อักขระ แต่อาร์เรย์ผู้พูดและบทสนทนาไม่มีขีดจำกัดรวม
ราคาของ token อินพุตพิสูจน์ต้นทุนกรณีสูงสุดของ token เสียงขาออกไม่ได้

ยังใช้ไม่ได้

หน้านี้มีไว้สำหรับดูความสามารถ กรณีใช้งาน และข้อมูลสาธารณะของโมเดลเท่านั้น โมเดลนี้จะไม่แสดงในพื้นที่ทำงานหน้าหลักและส่งงานสร้างไม่ได้ ตัวเลือก Gemini TTS สำหรับการสร้างเสียงที่รวดเร็วและการควบคุมบทสนทนาหลายตัวละคร

หน้านี้ยังไม่มีพารามิเตอร์เพิ่มเติมสำหรับผู้ใช้

คำถามที่พบบ่อย

โมเดลประเภทเดียวกันที่แนะนำ

ยังไม่ได้เลือก? ลองเปรียบเทียบตัวเลือกประเภทเดียวกันเหล่านี้ด้วย

ElevenLabs Dialogue V3

ElevenLabs Dialogue V3 ปัจจุบันสร้างบทสนทนาทีละบรรทัด โดยใส่บทพูดและเลือกเสียงในแต่ละบรรทัด ส่วน Kyeo AI คิดค่าบริการตามจำนวนตัวอักษรรวมของบทพูด ไม่ใช่ตัวแทนเสียงแบบเรียลไทม์ และข้อมูลทางการยังระบุว่าอาจต้องสร้างหลายครั้งจึงจะเลือกผลลัพธ์ที่ใช้ได้ หน้านี้แนะนำให้ใช้ตัวอย่างตรวจสอบการสลับตัวละคร ป้ายอารมณ์ รหัสภาษา รูปแบบเอาต์พุต หรือความครบถ้วนของสคริปต์ยาวก่อน

โมเดลเสียง AI
14 เครดิต / 1,000 ตัวอักษร

ElevenLabs Turbo 2.5

ElevenLabs Turbo 2.5 คือขั้นตอนข้อความเป็นเสียงพูดสำหรับผู้พูดคนเดียวที่ Kyeo ยังเปิดไว้ปัจจุบัน เลือกเสียงบนเว็บไซต์และปรับ stability, similarity_boost, style, speed, timestamps, บริบทก่อนและหลัง รวมถึง language_code ได้ แม้ยังส่งงานได้ แต่ ElevenLabs แนะนำให้ใช้ Flash v2.5 แทนแล้ว หน้านี้ไม่ถือว่าความหน่วงต่ำ การรองรับภาษา ความแม่นยำของ timestamp สิทธิ์ของเสียง หรือคุณภาพเอาต์พุตเป็นสิ่งที่ Kyeo รับประกัน

โมเดลเสียง AI
6 เครดิต / 1,000 ตัวอักษร

ElevenLabs Multilingual V2

ElevenLabs Multilingual V2 คือหน้าพากย์เสียงผู้พูดคนเดียวที่เน้นความเป็นธรรมชาติสูงซึ่ง Kyeo AI เชื่อมต่ออยู่ปัจจุบัน แม้ใช้แบบฟอร์มคล้าย Turbo 2.5 แต่ขอบเขตงานต่างกันจริง: Turbo เป็นพื้นฐานพากย์เสียงเร็ว ส่วน Multilingual V2 เหมาะเป็นตัวหลักสำหรับเสียงบรรยายยาว คอนเทนต์ข้ามภาษา และน้ำเสียงแบรนด์ระยะยาว ปัจจุบันยังใช้รายการตัวละครเสียงแบบตายตัวและช่องทาง 5,000 ตัวอักษรเหมือนกัน แต่การตัดสินใจเปลี่ยนจากความเร็วมาเป็นความคงที่ของเสียงและความคุ้มค่าของต้นทุนต่อตัวอักษรที่สูงเป็นสองเท่า

โมเดลเสียง AI
12 เครดิต / 1,000 ตัวอักษร

แหล่งข้อมูล

เนื้อหาในหน้านี้เรียบเรียงจากข้อมูลโมเดล คำอธิบายฟีเจอร์ และการตั้งค่าที่พร้อมใช้ปัจจุบันบน Kyeo AI

หมายเหตุแหล่งข้อมูล

ยืนยันข้อกำหนดด้านผู้พูด บทสนทนา การควบคุมเสียง และอัตรา token ของ Gemini 3.1 Flash TTS แล้ว แต่ยังพิสูจน์เพดานสูงสุดของ token เสียงขาออกก่อนสร้างคำขอไม่ได้ เว็บไซต์จึงยังไม่เปิดให้สร้างเสียง

อัปเดตล่าสุด: 2026-08-28
Gemini 3.1 Flash TTS — ยังไม่เปิดให้สร้างชั่วคราว
บทประเมิน