أُطلق النموذجان في 28 سبتمبر 2026: يركّز Eleven v4 على الأداء الصوتي التعبيري، بينما يستهدف v4 Turbo تطبيقات المحادثة الفورية. يدعم النموذجان أكثر من 90 لغة واستنساخ الصوت؛ وتقول ElevenLabs إن استنساخًا فوريًا يمكن إنشاؤه من تسجيل لا تتجاوز مدته 10 ثوانٍ.
نشر بواسطةتم التحرير باستخدام GPT-6 Lunaتم إنشاء الصور باستخدام GPT Image 2
إجابة البحث

Create a landscape editorial hero image for this Studio Global article: What are ElevenLabs’ new Eleven v4 and Eleven v4 Turbo text-to-speech models, how do their availability, architecture, voice cloning, langua. Article summary: ElevenLabs launched Eleven v4 and Eleven v4 Turbo on September 28, 2026: v4 prioritizes expressive, produced speech, while Turbo trades some emphasis on maximum quality for the speed needed by live voice agents. Together. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
يفصل إطلاق ElevenLabs في 28 سبتمبر 2026 بين خيارين لاستخدامات مختلفة: Eleven v4 لإنتاج صوت تعبيري يمكن التحكم في أدائه، وEleven v4 Turbo للتطبيقات التي تتطلب استجابة سريعة، مثل وكلاء المحادثة الصوتية. يدعم النموذجان أكثر من 90 لغة واستنساخ الصوت، لكن اختيار الأنسب يعتمد على طبيعة المشروع، لا على أرقام الإطلاق وحدها. 5
11
17
| Eleven v4 | Eleven v4 Turbo | |
|---|---|---|
| الاستخدام المقصود | صناعة المحتوى والكتب الصوتية وأداء أصوات الشخصيات، عندما تكون جودة الأداء أولوية |
المحادثات الفورية وتجارب الصوت التفاعلية ووكلاء المحادثة |
| محور التركيز | التعبير والتحكم بطريقة إلقاء النص |
خفض زمن الاستجابة لتوليد الكلام |
| زمن الاستجابة المعلن | لا تتضمن المصادر المتاحة رقمًا مماثلًا للمقارنة | وسيط زمن استدلال يقارب 100 مللي ثانية، ووسيط زمن حتى بدء الكلام يقارب 150 مللي ثانية، بحسب ElevenLabs |
| اللغات | أكثر من 90 لغة |
أكثر من 90 لغة |
| التوفر | عبر ElevenAPI وElevenAgents وElevenCreative |
عبر ElevenAPI وElevenAgents وElevenCreative |
إذا كان المشروع يعتمد على نبرة الصوت والعاطفة والتحكم في أداء النص، فابدأ بتجربة v4. أما إذا كان الصوت جزءًا من تفاعل مباشر ويهمك تقليل الانتظار، فاختبر Turbo. وتصف الوثائق Turbo بأنه يحافظ على جودة عالية مع زمن استجابة أقل، لكنها لا تقدم مقارنة جودة مباشرة تغطي كل استخدام أو لغة. 17
تقول ElevenLabs إن v4 مبني على بنية جديدة صُممت لمنح المستخدمين تحكمًا أفضل في النبرة والإيقاع والعاطفة وأداء الشخصيات. لكن مواد الإطلاق العامة لا تقدم تفاصيل تقنية كافية لتقييم هذه البنية بصورة مستقلة. 5
10
ويتيح النموذج استخدام وسوم صوتية داخل النص لتوجيه طريقة إلقاء الجملة. كانت ElevenLabs قد طرحت الوسوم المضمّنة مع v3، وأفادت TechCrunch بأن v4 يتيح تكديس أكثر من وسم واتباع ترتيبها. 5 يمكن أن تمنح هذه الوسوم الكاتب توجيهًا أدق للأداء، لكن النتيجة النهائية تظل بحاجة إلى مراجعة للتأكد من أنها تناسب المشهد والنبرة المطلوبة.
ويدعم النموذجان أكثر من 90 لغة. وتقول الشركة إن إنشاء نسخة صوتية فورية مستنسخة قد يحتاج إلى 10 ثوانٍ فقط من الصوت. كما تعود ميزة استنساخ الصوت الاحترافي في v4، بعد أن كانت غير مدعومة في v3. 1
5
11
وللعمل على النصوص الطويلة، تقول ElevenLabs إن ميزة ترابط السياق تساعد في الحفاظ على إيقاع الإلقاء وأسلوبه عبر نص بأي طول. قد يفيد ذلك في الكتب الصوتية والمحتوى الممتد، لكن هذا وصف من الشركة للميزة، وليس دليلًا مستقلًا على ثبات كل صوت في جميع المشاريع. 11
تذكر ElevenLabs أن وسيط زمن الاستدلال في v4 Turbo يقارب 100 مللي ثانية، وأن وسيط الزمن حتى بدء الكلام يقارب 150 مللي ثانية. وهذان قياسان مختلفان: الأول يتعلق بزمن الاستدلال، والثاني بالمدة قبل أن يبدأ النموذج الكلام. ولا يكفي أيّ منهما بمفرده لتحديد مدى سرعة محادثة كاملة مع وكيل صوتي. 11
فالتفاعل المباشر يشمل أيضًا استقبال كلام المستخدم ومعالجته، وتوليد الرد، ثم إيصاله عبر الشبكة. لذلك من الأفضل اعتبار الأرقام المنشورة مواصفات تخص النموذج، ثم قياس زمن الاستجابة من طرف إلى طرف داخل التطبيق والاتصال اللذين تنوي استخدامهما.
أفاد تقرير الإطلاق بأن Artificial Analysis وضع Eleven v4 في المرتبة الأولى على لوحة Provider Voice Arena. وهذه نتيجة تخص v4 في تقييم بعينه، ولا تثبت أنه الأفضل في كل لغة أو صوت أو مهمة طويلة أو إعداد لوكيل مباشر. 6 كذلك لا يصح نقل هذا الترتيب تلقائيًا إلى Turbo؛ إذ لا يظهر في معلومات التقييم المتاحة تصنيف عام منفصل ومستند إلى مصادر له.
18
وتظهر شركتا Cartesia وInworld ضمن الخيارات الأخرى التي تتناولها تغطيات أدوات الصوت الفوري. لذلك، عند المقارنة، اختبر الأصوات وزمن الاستجابة باستخدام النصوص نفسها وظروف الشبكة وسير عمل الوكيل نفسه، بدل الاعتماد على أرقام السرعة التي تعلنها الشركات وحدها. 19
يعكس تقسيم النماذج استراتيجية منتج واضحة: تلبية احتياجات صناع المحتوى الذين يريدون أداءً تعبيريًا مضبوطًا، إلى جانب استهداف الشركات التي تبني وكلاء صوتيين يعملون لحظيًا. لكنه يوضح اتجاه الشركة، ولا يثبت بحد ذاته أن أحد النموذجين حسم المنافسة.
وأعلنت الشركة أن إيراداتها السنوية المتكررة تجاوزت 500 مليون دولار في الأشهر الأربعة الأولى من 2026، فيما قيّمت جولة تمويل أُعلن عنها في فبراير 2026 الشركة بنحو 11 مليار دولار. 32
33 وفي سبتمبر، أفادت TechCrunch بأن الشركة تسير نحو إيرادات سنوية متكررة تبلغ 600 مليون دولار، وأن مستثمريها يقدّرون قيمتها، وفق تقارير، بنحو 22 مليار دولار. وهذا التقدير المعلن عنه في التقارير لا يعني إتمام جولة تمويل جديدة. كما تناول التقرير توقيت طرح محتمل للاكتتاب بوصفه طموحًا، لا إدراجًا معلنًا.
28
وأشارت TechCrunch أيضًا إلى Decagon، وهي شركة كانت عميلة لـElevenLabs وأصبحت منافسًا لها في منتجات الصوت الموجهة للعملاء. وهذا مثال على احتدام المنافسة في السوق المحيط بتقنيات الصوت، لا في نماذج تحويل النص إلى كلام وحدها. 28
الخلاصة العملية: ابدأ من الاستخدام الذي تريد بناءه، ثم اختبر الصوت وسير العمل الفعليين. قارن v4 وTurbo على النص أو مهمة الوكيل نفسها، وقِس زمن الاستجابة الكامل، وتحقق من جودة استنساخ الصوت وثبات الأداء في النصوص الطويلة. يوضح الإطلاق خيارًا بين التعبير والسرعة، لكنه لا يحسم مسبقًا أيّ النموذجين سيناسب مشروعك أكثر.
Studio Global AI
تتضمن هذه الصفحة إجابة مدعومة بالمصدر يمكنك المتابعة داخل Studio Global.
أُطلق النموذجان في 28 سبتمبر 2026: يركّز Eleven v4 على الأداء الصوتي التعبيري، بينما يستهدف v4 Turbo تطبيقات المحادثة الفورية.
أُطلق النموذجان في 28 سبتمبر 2026: يركّز Eleven v4 على الأداء الصوتي التعبيري، بينما يستهدف v4 Turbo تطبيقات المحادثة الفورية. يدعم النموذجان أكثر من 90 لغة واستنساخ الصوت؛ وتقول ElevenLabs إن استنساخًا فوريًا يمكن إنشاؤه من تسجيل لا تتجاوز مدته 10 ثوانٍ.
تذكر الشركة أن وسيط زمن الاستدلال في Turbo يبلغ نحو 100 مللي ثانية، لكن هذا لا يساوي زمن استجابة المساعد الصوتي كاملًا.