الانتقال إلى المحتوى الرئيسي
نموذج صوت بالذكاء الاصطناعي
ElevenLabs
ElevenLabs Dialogue

ElevenLabs Dialogue V3

يوفر ElevenLabs Dialogue V3 حاليًا توليد الحوار سطرًا بسطر: اكتب الحوار واختر صوتًا لكل سطر، ويفوتر Kyeo AI بحسب إجمالي أحرف الحوار. وهو ليس وكيلًا صوتيًا لحظيًا؛ وتشير المواد الرسمية أيضًا إلى احتمال الحاجة إلى عدة عمليات توليد لاختيار نتيجة صالحة. يوصي الموقع باختبار عينة أولًا للتحقق من تبديل الشخصيات ووسوم الانفعال ورمز اللغة وتنسيق الإخراج واكتمال النص الطويل.

وسم القدرة
تحويل الحوار إلى صوت
استهلاك النقاط
14 نقطة / 1000 حرف
حد الموجّه
5,000 حرف
حد الرفع
لا حاجة إلى رفع ملفات
يدعم حاليًا `dialogue-to-audio` فقط، وليس خدمة حوار لحظية
جوهر النص الحالي هو `dialogue[]`، ويجب أن يتضمن كل سطر `text + voice`.
تُحسب التكلفة على إجمالي طول الحوار بمعدل `14` نقطة لكل 1000 حرف JavaScript، مع التقريب إلى الأعلى
توصي المواد الرسمية بألا يتجاوز إجمالي النص 2,000 حرف، بينما تعرض صفحة الموقع حدًا قدره 5,000 حرف
تعرّف عليه في 30 ثانية
ElevenLabs Dialogue
14 نقطة / 1000 حرف
ما الذي يتقنه؟
يقدّم الموقع حاليًا Dialogue V3 بوصفه صفحة لتوليد الحوار مع تعيين صوت لكل سطر، لا بوصفه TTS عاديًا لمتحدث واحد أو خدمة حوار لحظية.
لمن يناسب؟
مناسب لحوارات البودكاست ونصوص المشاهد القصيرة وصوت التفاعل بين الشخصيات وبرامج السرد متعددة المتحدثين ومهام الحوار التي تتطلب تعيين صوت لكل جملة.
عمليات البحث الشائعة
كيفية استخدام ElevenLabs Dialogue V3سعر ElevenLabs Dialogue V3كيف يمكن إنشاء حوار متعدد الشخصيات في ElevenLabs Dialogue V3؟

خلاصة في جملة

كيف يبدو هذا النموذج؟

يوفر الموقع 20 صوتًا اختياريًا، ويطبق حدًا إجماليًا قدره 5,000 حرف على جميع أسطر الحوار، ويقصر كل طلب على 10 أصوات مختلفة كحد أقصى. لا تتوفر حاليًا عناصر التحكم في تنسيق الإخراج وseed وتوحيد النص وقاموس النطق؛ لذا اختبر نصًا قصيرًا قبل الاستخدام الرسمي.

ما الذي يتقنه؟
يقدّم الموقع حاليًا Dialogue V3 بوصفه صفحة لتوليد الحوار مع تعيين صوت لكل سطر، لا بوصفه TTS عاديًا لمتحدث واحد أو خدمة حوار لحظية.
لمن يناسب؟
مناسب لحوارات البودكاست ونصوص المشاهد القصيرة وصوت التفاعل بين الشخصيات وبرامج السرد متعددة المتحدثين ومهام الحوار التي تتطلب تعيين صوت لكل جملة.
لماذا تستخدمه في Kyeo AI؟
تفصل مساحة العمل بين نص كل سطر واختيار صوته، وتعرض الفوترة بحسب إجمالي الأحرف، مما يسهّل فحص بنية النص والميزانية؛ لكن ذلك لا يثبت أن تمييز الشخصيات أو إيقاع تبادل الأدوار سيطابق التوقعات.

المعلمات الأساسية

يساعدك على تقييم مدى ملاءمة النموذج لسيناريو عملك بسرعة.

فئة النموذج
نموذج صوت بالذكاء الاصطناعي
الشركة المطوّرة
ElevenLabs
عائلة النموذج
ElevenLabs Dialogue
وسم القدرة
مهمة غير متزامنة
استهلاك النقاط
ElevenLabs Dialogue — مهمة غير متزامنة
طريقة التشغيل
مهمة غير متزامنة
حد الموجّه
5,000 حرف
حد الرفع
لا حاجة إلى رفع ملفات

أسماء أخرى

قد يحمل النموذج نفسه أسماء مختلفة في المصادر المختلفة؛ جُمعت هنا بصورة موحدة لتسهيل البحث والمقارنة.

ElevenLabs Dialogue — هل يناسب ElevenLabs Dialogue V3 حوارات البودكاست
Eleven v3
Dialogue Mode

أسئلة المستخدمين الشائعة

تركز هذه الأسئلة العملية على المهمة وشروط الإدخال والنتيجة التي ينبغي تأكيدها قبل الاختيار.

كيفية استخدام ElevenLabs Dialogue V3
سعر ElevenLabs Dialogue V3
كيف يمكن إنشاء حوار متعدد الشخصيات في ElevenLabs Dialogue V3؟
كيف تُكتب مصفوفة dialogue في ElevenLabs Dialogue V3؟
ElevenLabs Dialogue V3 default_voice
ما الفارق بين ElevenLabs Dialogue V3 وTurbo 2.5؟
الفرق بين ElevenLabs Dialogue V3 وMultilingual V2
هل يناسب ElevenLabs Dialogue V3 حوارات البودكاست
هل يناسب ElevenLabs Dialogue V3 دبلجة المشاهد القصيرة
ElevenLabs Dialogue V3 مقابل 14 نقطة لكل 1000 حرف

دليل الاختيار

هل ما زلت مترددًا في اختيار النموذج؟ ابدأ بهذه النقاط الأساسية.

1
متى تعطيه الأولوية؟

إذا كان النص يتكون من عدة أدوار كلامية ويتطلب تحديد صوت لكل سطر، فأدرج Dialogue V3 في اختبار عينة قصيرة. تحقق أولًا من تبديل الأصوات واكتمال الإخراج، ثم قرر ما إذا كنت ستزيد الطول.

2
متى تقارن بنموذج آخر أولًا؟

للسرد المتواصل بصوت واحد، قارن أولًا بمسار TTS لمتحدث واحد. كما أنه لا يناسب وكيلًا صوتيًا تفاعليًا لحظيًا، لأن المواد الرسمية توضح أن Text to Dialogue ليس تطبيقًا لحظيًا.

3
مسار التحقق الأدنى

اختبر أولًا صوتين وعددًا قليلًا من الأدوار للتحقق من النطق والتبديل والاقتطاع وتنسيق الصوت والنقاط الفعلية المخصومة.

المقارنات الشائعة في البحث

قارن البدائل الشائعة في المهمة نفسها لتوضيح الفروق في المدخلات والتحكم والتكلفة.

ما الفرق بين ElevenLabs Dialogue V3 وElevenLabs Multilingual V2، وأيهما تختار؟
ElevenLabs Dialogue V3 مقابل ElevenLabs Multilingual V2
الفرق بين ElevenLabs Dialogue V3 وElevenLabs Turbo 2.5
ElevenLabs Dialogue V3 مقابل ElevenLabs Turbo 2.5

جدول مقارنة النماذج

هل تتردد بين الخيارات؟ يوضح هذا الجدول أهم الفروق بين النموذج الحالي وبدائله بنظرة واحدة.

الدور الحالي داخل الموقع
ElevenLabs Dialogue V3
صفحة حوار مكتوب متعدد الشخصيات
ElevenLabs Multilingual V2
صفحة اختبار TTS متعدد اللغات لمتحدث واحد
ElevenLabs Turbo 2.5
صفحة مقارنة TTS لمتحدث واحد بسعر أقل
الإدخال الأساسي الحالي
ElevenLabs Dialogue V3
`text + voice` لكل سطر في `dialogue[]`
ElevenLabs Multilingual V2
نص واحد + voice لمتحدث واحد
ElevenLabs Turbo 2.5
نص واحد + voice لمتحدث واحد + طابع زمني / سياق سابق ولاحق
التسعير الحالي
ElevenLabs Dialogue V3
14 نقطة / 1000 حرف
ElevenLabs Multilingual V2
12 نقطة / 1000 حرف
ElevenLabs Turbo 2.5
6 نقاط / 1000 حرف
المهمة الأنسب
ElevenLabs Dialogue V3
حوارات البودكاست والمشاهد القصيرة والمقاطع التفاعلية متعددة الشخصيات
ElevenLabs Multilingual V2
سرد لمتحدث واحد واختبار النطق متعدد اللغات
ElevenLabs Turbo 2.5
عينة TTS لمتحدث واحد بسعر أقل

تجربة الاستخدام الفعلية

إرشادات عملية تستند إلى مصادر عامة وحدود الموقع الحالية ومهام تمثل الاحتياجات الشائعة.

من السهل وصف هذه الصفحة خطأ بأنها «TTS أقوى»، لكنها ليست كذلك

إذا استُخدم قالب «الطبيعية وتعدد اللغات وانخفاض زمن الاستجابة» نفسه لوصفها، فسيبتعد الوصف حتمًا عن حقيقتها.

ينبغي تقييم الحوار متعدد الشخصيات بحسب الإيقاع العام ووضوح التمييز بينها

يبدأ كثيرون بسماع مدى واقعية جملة واحدة، لكن المقارنة الأهم في Dialogue V3 هي الإيقاع ووضوح التمييز والطابع الدرامي العام عند تبادل عدة أشخاص الحديث. هذا المعيار أقرب إلى قابلية الاستخدام الفعلية من نبرة جملة منفردة.

تفاصيل القدرات

ElevenLabs Dialogue: طريقة إدخال واضحة

ElevenLabs Dialogue: طريقة إدخال واضحة — تعرّف على الحوار سطرًا بسطر واختيار الأصوات وحد 5,000 حرف في ElevenLabs Dialogue V3 على Kyeo AI، وحدود الفوترة الفعلية البالغة 14 نقطة لكل ألف حرف.

لعدد الأصوات ورمز اللغة حدود مستقلة

يعرض الموقع 20 صوتًا، لكن الطلب الواحد يدعم رسميًا 10 قيم `voice_id` فريدة كحد أقصى.

الفوترة المحلية تحسب أحرف الحوار فقط

يجمع الموقع قيمة `length` في JavaScript لنصوص جميع أسطر `dialogue[]`، ثم يقرب التكلفة إلى الأعلى بمعدل `14 / 1000 حرف`. لا يدخل عدد الأصوات ورمز اللغة والإعدادات في التقدير.

الاستخدامات المناسبة

عينات المشاهد القصيرة وتفاعل الشخصيات

من الأنسب البدء بحوار مدته 15 إلى 30 ثانية لفحص تمييز الشخصيات وإيقاع تبادل الأدوار، بدلًا من إنشاء قصة طويلة منذ البداية.

تبادل الحديث بين مقدم البودكاست والضيف

مناسب لمقاطع البرامج التي تتطلب تقسيمًا واضحًا للأدوار ونبرات مختلفة وعلاقة واضحة في تبادل الكلام بين شخصين أو أكثر.

عرض منتج متعدد الشخصيات أو محتوى بعلامة تجارية مجسدة في شخصيات

مناسب للمحتوى الصوتي الذي يحتاج إلى حضور شخصيات وتفاعل وحدود أوضح بينها.

نصائح الموجّه

جملة واحدة في كل سطر، وحدد أدوار الشخصيات أولًا

الأهم في هذه الصفحة ليس البلاغة بل بنية النص. حدّد أولًا من يقول كل جملة وأين يتوقف ومن يبدأ الجملة التالية.

اختبر التمييز بعينة قصيرة أولًا

في Dialogue V3، يكون البدء بعينة حوار واقعية مدتها 15 إلى 30 ثانية عادةً أكثر أمانًا من إدخال قصة طويلة كاملة مباشرة.

voice الافتراضي احتياطي وليس عنصر التحكم الأساسي

ما يحدد النتيجة فعليًا هو voice لكل سطر في `dialogue[]`. أما `default_voice` فهو أقرب إلى خيار احتياطي، وليس معلمة أساسية تحل محل التعيين سطرًا بسطر.

أسباب اختياره

يوفر الموقع حاليًا سير عمل واضحًا لحوار متعدد الشخصيات عبر `dialogue[]`.
يمكن تعيين voice مستقل لكل سطر، مما يلائم المحتوى التفاعلي المكتوب.
يمكن استخدام نص قصير لاختبار تبديل الأصوات والنطق وبنية الأدوار.
تختلف بنية الإدخال عن TTS لمتحدث واحد، لذلك يسهل تمييز حدود المهمة.

ما يجب معرفته قبل الاستخدام

ليست هذه حاليًا صفحة سرد عادي لمتحدث واحد ولا وكيلًا صوتيًا لحظيًا.
توصي المواد الرسمية بألا يتجاوز إجمالي النص 2,000 حرف؛ ويقبل Kyeo ما يصل إلى 5,000 حرف، لكن يظل من المستحسن البدء بطول أكثر تحفظًا للحوار الطويل.
الحد الرسمي هو 10 أصوات مختلفة لكل مرة، ويرفض Kyeo الطلب الذي يتجاوز هذا العدد قبل إنشاء المهمة.
قبل الاستخدام الرسمي، افحص تمييز الشخصيات والإيقاع والنطق وترخيص الأصوات باستخدام نص ممثل.

المعلمات القابلة للضبط

يساعدك على تقييم مدى ملاءمة النموذج لسيناريو عملك بسرعة.

الدور الصوتي الافتراضي
default_voice
اختياري
نوع المعلمة: select
القيمة الافتراضية: pNInz6obpgDQGcFmaJgB
Adam
Alice
Bill
Brian
Callum
Charlie
20 خيارًا
الاستقرار
stability
اختياري
نوع المعلمة: select
القيمة الافتراضية: 0.5
0.0
0.5
1.0
رمز اللغة
language_code
اختياري
نوع المعلمة: text

استهلاك النقاط

14 نقطة / 1000 حرف

السعر الخام 14 نقطة لكل 1000 حرف؛ الخصم المحلي Math.ceil(إجمالي أحرف dialogue[] × 14 / 1000)، min=1 نقطة.

نصيحة لتوفير النقاط

قبل توليد الصور أو الفيديو على دفعات، يُنصح بإجراء اختبار A/B بالمواد نفسها بين النموذج الحالي وبدائله من النوع نفسه، ثم بدء التوليد على دفعات بعد تأكيد النتيجة لتجنب هدر النقاط.

الأسئلة الشائعة

نماذج مشابهة موصى بها

لم تقرر بعد؟ قارن أيضًا بهذه البدائل المشابهة.

ElevenLabs Multilingual V2

ElevenLabs Multilingual V2 هو خيار Kyeo AI الحالي للتعليق الصوتي الفردي عالي الطبيعية. يشترك مع Turbo 2.5 في واجهة متقاربة، لكن حدود المهمة الفعلية تختلف: Turbo أقرب إلى خط أساس للتعليق السريع، بينما Multilingual V2 أقرب إلى خيار أساسي للسرد الطويل والمحتوى العابر للغات والحفاظ على صوت العلامة التجارية. يستخدم كلاهما داخل المنصة حاليًا قائمة ثابتة من الأصوات وحد تكامل يبلغ 5,000 حرف، لكن القرار هنا ينتقل من السرعة إلى ثبات الاستماع وما إذا كان يستحق ضعف تكلفة الأحرف.

نماذج الصوت بالذكاء الاصطناعي
12 نقطة / 1,000 حرف

ElevenLabs Turbo 2.5

ElevenLabs Turbo 2.5 هو سير العمل الفردي الحالي لتحويل النص إلى كلام الذي لا تزال Kyeo توفره. يمكنك اختيار صوت من المنصة وضبط stability وsimilarity_boost وstyle وspeed وtimestamps والسياق السابق واللاحق وlanguage_code. لا يزال بالإمكان إرسال المهام إليه، لكن ElevenLabs توصي الآن باستبداله بـ Flash v2.5؛ ولا تعتبر الصفحة انخفاض زمن الاستجابة أو دعم اللغات أو دقة الطوابع الزمنية أو ترخيص الصوت أو جودة المخرجات ضمانًا من Kyeo.

نماذج الصوت بالذكاء الاصطناعي
6 نقاط / 1,000 حرف

Suno Music

Suno Music هو مدخل Kyeo AI لتوليد الموسيقى من النص. لا يوفر النموذج الحالي سوى الموجّه والإصدار وخيار الموسيقى الآلية؛ وبعد نجاح التوليد، يمكن تمديد النتائج المؤهلة أو تحويلها إلى WAV أو فصل الغناء عنها. لا توفر الصفحة عناصر التحكم المتاحة في منتج Suno الرسمي، مثل الكلمات والعنوان ووزن الأسلوب وPersona وVoices وCustom Models وMy Taste.

نموذج صوت بالذكاء الاصطناعي
التوليد / التمديد: 12 نقطة / مرة

مصادر المعلومات

أُعد محتوى الصفحة استنادًا إلى معلومات النموذج ووصف الوظائف والإعدادات المتاحة حاليًا في Kyeo AI.

ملاحظة المصدر

تعرّف على الحوار سطرًا بسطر واختيار الأصوات وحد 5,000 حرف في ElevenLabs Dialogue V3 على Kyeo AI، وحدود الفوترة الفعلية البالغة 14 نقطة لكل ألف حرف. السعر الخام 14 نقطة لكل 1000 حرف؛ الخصم المحلي Math.ceil(إجمالي أحرف dialogue[] × 14 / 1000)، min=1 نقطة.

آخر تحديث: 2026-07-20
ElevenLabs Help: What is Eleven v3?
رسمي
عرض المصدر الأصلي
ElevenLabs Help: What is Dialogue mode?
رسمي
عرض المصدر الأصلي
ElevenLabs Docs: Models
رسمي
عرض المصدر الأصلي
ElevenLabs Docs: Text to Dialogue
رسمي
عرض المصدر الأصلي
ElevenLabs API: Create dialogue
رسمي
عرض المصدر الأصلي