ข้ามไปยังเนื้อหาหลัก
โมเดลเสียง AI
ElevenLabs
ElevenLabs Dialogue

ElevenLabs Dialogue V3

ElevenLabs Dialogue V3 ปัจจุบันสร้างบทสนทนาทีละบรรทัด โดยใส่บทพูดและเลือกเสียงในแต่ละบรรทัด ส่วน Kyeo AI คิดค่าบริการตามจำนวนตัวอักษรรวมของบทพูด ไม่ใช่ตัวแทนเสียงแบบเรียลไทม์ และข้อมูลทางการยังระบุว่าอาจต้องสร้างหลายครั้งจึงจะเลือกผลลัพธ์ที่ใช้ได้ หน้านี้แนะนำให้ใช้ตัวอย่างตรวจสอบการสลับตัวละคร ป้ายอารมณ์ รหัสภาษา รูปแบบเอาต์พุต หรือความครบถ้วนของสคริปต์ยาวก่อน

ป้ายกำกับความสามารถ
บทสนทนาเป็นเสียง
เครดิตที่ใช้
14 เครดิต / 1,000 ตัวอักษร
ขีดจำกัดพรอมต์
5,000 ตัวอักษร
ขีดจำกัดการอัปโหลด
ไม่ต้องอัปโหลดไฟล์
ปัจจุบันรองรับเฉพาะ `dialogue-to-audio` ไม่ใช่บริการสนทนาแบบเรียลไทม์
โครงสร้างหลักของสคริปต์ปัจจุบันคือ `dialogue[]` โดยทุกบรรทัดต้องมี `text + voice`
ความยาวรวมของบทพูดคิด `14` เครดิต / 1,000 ตัวอักษร JavaScript โดยปัดขึ้น
ข้อมูลทางการแนะนำข้อความรวมไม่เกิน 2,000 ตัวอักษร ขณะที่หน้าเว็บไซต์ระบุขีดจำกัด 5,000 ตัวอักษร
เข้าใจใน 30 วินาที
ElevenLabs Dialogue
14 เครดิต / 1,000 ตัวอักษร
ถนัดด้านใด
เว็บไซต์ปัจจุบันใช้ Dialogue V3 เป็นหน้าสร้างบทสนทนาที่กำหนดเสียงทีละบรรทัด ไม่ใช่ TTS ผู้พูดคนเดียวทั่วไปหรือบริการสนทนาแบบเรียลไทม์
เหมาะกับใคร
เหมาะกับบทสนทนาพอดแคสต์ สคริปต์ละครสั้น เสียงโต้ตอบระหว่างตัวละคร รายการเล่าเรื่องหลายคน และงานบทสนทนาที่ต้องกำหนดเสียงทีละประโยค
คำค้นหายอดนิยม
ใช้ ElevenLabs Dialogue V3 อย่างไรราคา ElevenLabs Dialogue V3บทสนทนาหลายตัวละคร ElevenLabs Dialogue V3

สรุปในประโยคเดียว

โมเดลนี้เป็นอย่างไร?

เว็บไซต์มีเสียงให้เลือก 20 เสียง จำกัดข้อความรวมทุกบรรทัดไว้ที่ 5,000 ตัวอักษร และจำกัดเสียงที่ต่างกันไม่เกิน 10 เสียงต่อคำขอ ปัจจุบันยังไม่มีตัวเลือกรูปแบบเอาต์พุต seed การปรับข้อความให้เป็นมาตรฐาน และพจนานุกรมการออกเสียง จึงควรทดสอบด้วยสคริปต์สั้นก่อนใช้งานจริง

ถนัดด้านใด
เว็บไซต์ปัจจุบันใช้ Dialogue V3 เป็นหน้าสร้างบทสนทนาที่กำหนดเสียงทีละบรรทัด ไม่ใช่ TTS ผู้พูดคนเดียวทั่วไปหรือบริการสนทนาแบบเรียลไทม์
เหมาะกับใคร
เหมาะกับบทสนทนาพอดแคสต์ สคริปต์ละครสั้น เสียงโต้ตอบระหว่างตัวละคร รายการเล่าเรื่องหลายคน และงานบทสนทนาที่ต้องกำหนดเสียงทีละประโยค
ทำไมจึงใช้บน Kyeo AI
พื้นที่ทำงานแยกบทพูดแต่ละบรรทัดออกจากตัวเลือกเสียง และแสดงค่าบริการตามจำนวนตัวอักษรรวม ช่วยตรวจโครงสร้างสคริปต์และงบประมาณ แต่ไม่ได้ยืนยันว่าตัวละครจะแตกต่างกันหรือจังหวะรับส่งบทจะตรงตามคาดเสมอ

พารามิเตอร์สำคัญ

ช่วยให้ประเมินได้รวดเร็วว่าโมเดลนี้เหมาะกับกรณีใช้งานทางธุรกิจของคุณหรือไม่

ประเภทโมเดล
โมเดลเสียง AI
ผู้พัฒนา
ElevenLabs
ตระกูลโมเดล
ElevenLabs Dialogue
ป้ายกำกับความสามารถ
งานแบบอะซิงโครนัส
เครดิตที่ใช้
ElevenLabs Dialogue — งานแบบอะซิงโครนัส
วิธีทำงาน
งานแบบอะซิงโครนัส
ขีดจำกัดพรอมต์
5,000 ตัวอักษร
ขีดจำกัดการอัปโหลด
ไม่ต้องอัปโหลดไฟล์

ชื่อเรียกอื่น

โมเดลเดียวกันอาจมีชื่อเรียกต่างกันในแหล่งข้อมูลแต่ละแห่ง ส่วนนี้รวบรวมไว้เพื่อให้ค้นหาและเปรียบเทียบได้ง่าย

ElevenLabs Dialogue — ElevenLabs Dialogue V3 เหมาะกับบทสนทนาพอดแคสต์ไหม
Eleven v3
Dialogue Mode

คำถามที่พบบ่อยของผู้ใช้

คำถามเชิงปฏิบัติเหล่านี้เน้นงาน เงื่อนไขอินพุต และผลลัพธ์ที่ควรยืนยันก่อนเลือก

ใช้ ElevenLabs Dialogue V3 อย่างไร
ราคา ElevenLabs Dialogue V3
บทสนทนาหลายตัวละคร ElevenLabs Dialogue V3
อาร์เรย์ dialogue ของ ElevenLabs Dialogue V3
ElevenLabs Dialogue V3 default_voice
ElevenLabs Dialogue V3 ต่างจาก Turbo 2.5 อย่างไร
ElevenLabs Dialogue V3 ต่างจาก Multilingual V2 อย่างไร
ElevenLabs Dialogue V3 เหมาะกับบทสนทนาพอดแคสต์ไหม
ElevenLabs Dialogue V3 เหมาะกับพากย์ละครสั้นไหม
ElevenLabs Dialogue V3 14 เครดิตต่อ 1,000 ตัวอักษร

คู่มือเลือกโมเดล

ยังไม่แน่ใจว่าจะใช้โมเดลใด? ลองดูปัจจัยสำคัญเหล่านี้ก่อน

1
เมื่อใดควรเลือกโมเดลนี้ก่อน

หากสคริปต์มีหลายรอบสนทนาและต้องกำหนดเสียงทีละบรรทัด ให้นำ Dialogue V3 มาทดสอบด้วยตัวอย่างสั้น ตรวจสอบการสลับเสียงและเอาต์พุตที่ครบถ้วนก่อนตัดสินใจเพิ่มความยาว

2
เมื่อใดควรเปรียบเทียบโมเดลอื่นก่อน

เสียงบรรยายต่อเนื่องโดยผู้พูดคนเดียวควรเปรียบเทียบเส้นทาง TTS ผู้พูดคนเดียวก่อน และไม่เหมาะกับตัวแทนเสียงที่ต้องโต้ตอบแบบเรียลไทม์ เพราะข้อมูลทางการระบุชัดว่า Text to Dialogue ไม่ใช่แอปแบบเรียลไทม์

3
เส้นทางทดสอบขั้นต่ำ

เริ่มด้วยเสียง 2 เสียงและรอบสนทนาไม่กี่รอบ เพื่อทดสอบการออกเสียง การสลับ การตัดขาด รูปแบบเสียง และเครดิตที่หักจริง

คำเปรียบเทียบที่ค้นหาบ่อย

เปรียบเทียบตัวเลือกที่พบบ่อยในงานเดียวกัน เพื่อดูความต่างด้านอินพุต การควบคุม และค่าใช้จ่าย

ElevenLabs Dialogue V3 ต่างจาก ElevenLabs Multilingual V2 อย่างไร และควรเลือกแบบไหน?
ElevenLabs Dialogue V3 vs ElevenLabs Multilingual V2
ElevenLabs Dialogue V3 ต่างจาก ElevenLabs Turbo 2.5 อย่างไร
ElevenLabs Dialogue V3 vs ElevenLabs Turbo 2.5

ตารางเปรียบเทียบโมเดล

ยังเลือกไม่ได้? ตารางนี้สรุปความแตกต่างหลักระหว่างโมเดลนี้กับตัวเลือกอื่นให้ดูได้ทันที

บทบาทปัจจุบันบนเว็บไซต์
ElevenLabs Dialogue V3
หน้าสร้างบทสนทนาหลายตัวละครจากสคริปต์
ElevenLabs Multilingual V2
หน้าทดสอบ TTS หลายภาษาสำหรับผู้พูดคนเดียว
ElevenLabs Turbo 2.5
หน้าเปรียบเทียบ TTS ผู้พูดคนเดียวที่มีอัตราค่าบริการต่ำกว่า
อินพุตหลักปัจจุบัน
ElevenLabs Dialogue V3
`text + voice` ในแต่ละบรรทัดของ `dialogue[]`
ElevenLabs Multilingual V2
ข้อความหนึ่งชุด + voice ผู้พูดคนเดียว
ElevenLabs Turbo 2.5
ข้อความหนึ่งชุด + voice ผู้พูดคนเดียว + timestamp / บริบทก่อนและหลัง
ราคาปัจจุบัน
ElevenLabs Dialogue V3
14 เครดิต / 1,000 ตัวอักษร
ElevenLabs Multilingual V2
12 เครดิต / 1,000 ตัวอักษร
ElevenLabs Turbo 2.5
6 เครดิต / 1,000 ตัวอักษร
งานที่เหมาะกว่า
ElevenLabs Dialogue V3
บทสนทนาพอดแคสต์ ละครสั้น และช่วงโต้ตอบหลายคน
ElevenLabs Multilingual V2
เสียงบรรยายคนเดียวและทดสอบการออกเสียงหลายภาษา
ElevenLabs Turbo 2.5
ตัวอย่าง TTS ผู้พูดคนเดียวที่มีอัตราค่าบริการต่ำกว่า

ประสบการณ์ใช้งานจริง

คำแนะนำเชิงปฏิบัติจากแหล่งข้อมูลสาธารณะ ขอบเขตปัจจุบันของเว็บไซต์ และงานตัวอย่างที่พบได้ทั่วไป

หน้านี้ถูกเข้าใจผิดว่าเป็น “TTS ที่เก่งกว่า” ได้ง่าย แต่ไม่ใช่

หากยังอธิบายด้วยกรอบเดิมเรื่อง “ความเป็นธรรมชาติ หลายภาษา และความหน่วงต่ำ” ก็จะผิดจากจุดประสงค์ของโมเดลนี้

ควรประเมินบทสนทนาหลายคนจากจังหวะโดยรวมและความแตกต่างของตัวละคร

หลายคนอาจฟังเพียงว่าประโยคหนึ่งเหมือนคนจริงหรือไม่ แต่สิ่งที่ควรเปรียบเทียบจริงสำหรับ Dialogue V3 คือจังหวะการโต้ตอบ ความแตกต่างระหว่างผู้พูด และอารมณ์โดยรวมเมื่อหลายคนสนทนากัน ตัวชี้วัดนี้ใกล้กับการใช้งานจริงมากกว่าน้ำเสียงของประโยคเดียว

รายละเอียดความสามารถ

ElevenLabs Dialogue: รูปแบบอินพุตที่ชัดเจน

ElevenLabs Dialogue: รูปแบบอินพุตที่ชัดเจน — ดูการสร้างบทสนทนาทีละบรรทัด การเลือกเสียง และขีดจำกัด 5,000 ตัวอักษรของ ElevenLabs Dialogue V3 บน Kyeo AI พร้อมขอบเขตค่าบริการ 14 เครดิตต่อ 1,000 ตัวอักษร

จำนวนเสียงและรหัสภาษามีขอบเขตแยกกัน

เว็บไซต์แสดงเสียง 20 เสียง แต่คำขอทางการหนึ่งครั้งใช้ `voice_id` ที่ไม่ซ้ำกันได้สูงสุด 10 รายการ

การคิดค่าบริการบนเว็บไซต์นับเฉพาะตัวอักษรของบทพูด

เว็บไซต์รวม JavaScript `length` ของข้อความทุกบรรทัดใน `dialogue[]` แล้วคิด `14 / 1,000 ตัวอักษร` โดยปัดขึ้น จำนวนเสียง รหัสภาษา และการตั้งค่าไม่นำมารวมในการประเมินราคา

เหมาะกับงานใด

ตัวอย่างละครสั้นและการโต้ตอบของตัวละคร

เหมาะสำหรับเริ่มด้วยบทสนทนาสั้น 15–30 วินาที เพื่อตรวจความแตกต่างของตัวละครและจังหวะรับส่งบท แทนที่จะเริ่มด้วยเรื่องยาวทันที

การโต้ตอบระหว่างผู้ดำเนินรายการ / แขกรับเชิญในพอดแคสต์

เหมาะกับช่วงรายการที่มีคนสองคนขึ้นไป โดยต้องแบ่งบทบาทชัดเจน ใช้น้ำเสียงต่างกัน และมีลำดับการรับส่งบทที่เข้าใจง่าย

การนำเสนอผลิตภัณฑ์หลายตัวละครหรือคอนเทนต์ตัวละครของแบรนด์

เหมาะกับคอนเทนต์เสียงที่ต้องการบุคลิกตัวละคร ความรู้สึกโต้ตอบ และขอบเขตระหว่างตัวละครที่ชัดเจนกว่า

เคล็ดลับการเขียนพรอมต์

หนึ่งประโยคต่อหนึ่งบรรทัด และกำหนดขอบเขตตัวละครก่อน

สิ่งสำคัญที่สุดในหน้านี้ไม่ใช่สำนวน แต่คือโครงสร้างสคริปต์ ควรระบุให้ชัดก่อนว่าแต่ละประโยคเป็นของใคร หยุดตรงไหน และใครพูดต่อ

ตรวจความแตกต่างด้วยตัวอย่างสั้นก่อน

สำหรับ Dialogue V3 วิธีที่มั่นคงกว่าคือเริ่มจากตัวอย่างบทสนทนาจริง 15–30 วินาที แทนที่จะใส่เรื่องยาวทั้งชุดทันที

voice เริ่มต้นเป็นเพียงค่ารองรับ ไม่ใช่ตัวควบคุมหลัก

สิ่งที่กำหนดผลลัพธ์จริงยังคงเป็น voice ในแต่ละบรรทัดของ `dialogue[]` ส่วน `default_voice` เป็นค่ารองรับมากกว่า ไม่ใช่พารามิเตอร์หลักที่ใช้แทนการกำหนดเสียงทีละบรรทัด

เหตุผลที่ควรเลือก

เว็บไซต์ปัจจุบันมีขั้นตอนบทสนทนาหลายตัวละครด้วย `dialogue[]` ที่ชัดเจน
กำหนด voice แยกให้บทพูดแต่ละบรรทัดได้ จึงเหมาะกับคอนเทนต์โต้ตอบที่มีสคริปต์มากกว่า
ใช้สคริปต์สั้นทดสอบการสลับเสียง การออกเสียง และโครงสร้างรอบสนทนาได้
โครงสร้างอินพุตต่างจาก TTS ผู้พูดคนเดียว จึงแยกขอบเขตงานได้ค่อนข้างง่าย

สิ่งที่ควรรู้ก่อนใช้

ปัจจุบันไม่ใช่หน้าเสียงบรรยายคนเดียวทั่วไปหรือตัวแทนเสียงแบบเรียลไทม์
ข้อมูลทางการแนะนำข้อความรวมไม่เกิน 2,000 ตัวอักษร ขณะที่ Kyeo รับได้สูงสุด 5,000 ตัวอักษร แต่บทสนทนายาวยังควรเริ่มด้วยความยาวที่รัดกุมกว่า
ข้อมูลทางการจำกัดเสียงที่ต่างกันไม่เกิน 10 เสียงต่อครั้ง และ Kyeo จะปฏิเสธคำขอที่เกินจำนวนนี้ก่อนสร้างงาน
ก่อนใช้งานจริง โปรดใช้สคริปต์ตัวแทนตรวจความแตกต่างของตัวละคร จังหวะ การออกเสียง และสิทธิ์ของเสียง

พารามิเตอร์ที่ปรับได้

ช่วยให้ประเมินได้รวดเร็วว่าโมเดลนี้เหมาะกับกรณีใช้งานทางธุรกิจของคุณหรือไม่

เสียงตัวละครเริ่มต้น
default_voice
ไม่บังคับ
ประเภทพารามิเตอร์: select
ค่าเริ่มต้น: pNInz6obpgDQGcFmaJgB
Adam
Alice
Bill
Brian
Callum
Charlie
มี 20 ตัวเลือก
ความคงที่
stability
ไม่บังคับ
ประเภทพารามิเตอร์: select
ค่าเริ่มต้น: 0.5
0.0
0.5
1.0
รหัสภาษา
language_code
ไม่บังคับ
ประเภทพารามิเตอร์: text

เครดิตที่ใช้

14 เครดิต / 1,000 ตัวอักษร

ราคาดิบ 14 เครดิตต่อ 1000 ตัวอักษร; หักในระบบ Math.ceil(ตัวอักษรรวม dialogue[] × 14 / 1000), min=1 เครดิต

เคล็ดลับประหยัดเครดิต

ก่อนสร้างภาพหรือวิดีโอจำนวนมาก แนะนำให้ทดสอบ A/B ด้วยสื่อชุดเดียวกันระหว่างโมเดลนี้กับตัวเลือกประเภทเดียวกัน ยืนยันผลลัพธ์ก่อนแล้วค่อยสร้างเป็นชุดเพื่อไม่ให้เสียเครดิตโดยเปล่าประโยชน์

คำถามที่พบบ่อย

โมเดลประเภทเดียวกันที่แนะนำ

ยังไม่ได้เลือก? ลองเปรียบเทียบตัวเลือกประเภทเดียวกันเหล่านี้ด้วย

ElevenLabs Multilingual V2

ElevenLabs Multilingual V2 คือหน้าพากย์เสียงผู้พูดคนเดียวที่เน้นความเป็นธรรมชาติสูงซึ่ง Kyeo AI เชื่อมต่ออยู่ปัจจุบัน แม้ใช้แบบฟอร์มคล้าย Turbo 2.5 แต่ขอบเขตงานต่างกันจริง: Turbo เป็นพื้นฐานพากย์เสียงเร็ว ส่วน Multilingual V2 เหมาะเป็นตัวหลักสำหรับเสียงบรรยายยาว คอนเทนต์ข้ามภาษา และน้ำเสียงแบรนด์ระยะยาว ปัจจุบันยังใช้รายการตัวละครเสียงแบบตายตัวและช่องทาง 5,000 ตัวอักษรเหมือนกัน แต่การตัดสินใจเปลี่ยนจากความเร็วมาเป็นความคงที่ของเสียงและความคุ้มค่าของต้นทุนต่อตัวอักษรที่สูงเป็นสองเท่า

โมเดลเสียง AI
12 เครดิต / 1,000 ตัวอักษร

ElevenLabs Turbo 2.5

ElevenLabs Turbo 2.5 คือขั้นตอนข้อความเป็นเสียงพูดสำหรับผู้พูดคนเดียวที่ Kyeo ยังเปิดไว้ปัจจุบัน เลือกเสียงบนเว็บไซต์และปรับ stability, similarity_boost, style, speed, timestamps, บริบทก่อนและหลัง รวมถึง language_code ได้ แม้ยังส่งงานได้ แต่ ElevenLabs แนะนำให้ใช้ Flash v2.5 แทนแล้ว หน้านี้ไม่ถือว่าความหน่วงต่ำ การรองรับภาษา ความแม่นยำของ timestamp สิทธิ์ของเสียง หรือคุณภาพเอาต์พุตเป็นสิ่งที่ Kyeo รับประกัน

โมเดลเสียง AI
6 เครดิต / 1,000 ตัวอักษร

Suno Music

Suno Music คือช่องทางสร้างเพลงจากข้อความบน Kyeo AI แบบฟอร์มปัจจุบันมีเพียงพรอมต์ รุ่น และสวิตช์เพลงบรรเลง เมื่อสร้างสำเร็จ ผลลัพธ์ที่เข้าเงื่อนไขสามารถนำไปต่อความยาว แปลงเป็น WAV หรือแยกเสียงร้องได้ หน้านี้ไม่มีตัวเลือกจากผลิตภัณฑ์ทางการ เช่น เนื้อเพลง ชื่อเพลง น้ำหนักสไตล์ Persona, Voices, Custom Models หรือ My Taste

โมเดลเสียง AI
สร้าง / ต่อความยาว 12 เครดิต / ครั้ง

แหล่งข้อมูล

เนื้อหาในหน้านี้เรียบเรียงจากข้อมูลโมเดล คำอธิบายฟีเจอร์ และการตั้งค่าที่พร้อมใช้ปัจจุบันบน Kyeo AI

หมายเหตุแหล่งข้อมูล

ดูการสร้างบทสนทนาทีละบรรทัด การเลือกเสียง และขีดจำกัด 5,000 ตัวอักษรของ ElevenLabs Dialogue V3 บน Kyeo AI พร้อมขอบเขตค่าบริการ 14 เครดิตต่อ 1,000 ตัวอักษร ราคาดิบ 14 เครดิตต่อ 1000 ตัวอักษร; หักในระบบ Math.ceil(ตัวอักษรรวม dialogue[] × 14 / 1000), min=1 เครดิต

อัปเดตล่าสุด: 2026-07-20
ElevenLabs Help: What is Eleven v3?
ทางการ
ดูแหล่งข้อมูลต้นฉบับ
ElevenLabs Help: What is Dialogue mode?
ทางการ
ดูแหล่งข้อมูลต้นฉบับ
ElevenLabs Docs: Models
ทางการ
ดูแหล่งข้อมูลต้นฉบับ
ElevenLabs Docs: Text to Dialogue
ทางการ
ดูแหล่งข้อมูลต้นฉบับ
ElevenLabs API: Create dialogue
ทางการ
ดูแหล่งข้อมูลต้นฉบับ