الأكثر تداولًا

البرمجيات

نموذج ElevenLabs الجديد v4 يتحدث الآن 90 لغة

كشفت ElevenLabs عن نموذجي الكلام v4 وv4 Turbo اللذين يدعمان 90 لغة، ويتيحان استنساخ الصوت من عينة صوتية مدتها 10 ثوانٍ فقط.

الإجابة المختصرة

أعلنت شركة الذكاء الاصطناعي الصوتي ElevenLabs عن جيلها الجديد من نماذج الكلام، مع دعم أوسع للغات وتحكم أدق في التعبير. تتيح البنية الجديدة استنساخ الصوت من عينة صوتية أقصر بكثير، وتحافظ على هوية الصوت بثبات أكبر عبر مقاطع نصية طويلة لمساعدات الصوت.

أبرز النقاط

  • أصبحت النماذج الجديدة تغطي عدداً من اللغات أكبر بكثير من الإصدار السابق.
  • يمكن للمستخدمين الآن استنساخ صوت باستخدام عينة صوتية مدتها 10 ثوانٍ فقط.
  • ارتفع معدل الإيرادات السنوي لشركة ElevenLabs بشكل ملحوظ منذ بداية العام.
واجهة تحرير صوتي رقمية تعرض موجة صوتية على الشاشة
الصورة: Egor Komarov / Pexels

مدة القراءة 1 دقيقةرئيس التحرير: Uğur Deniz İlhan

أعلنت ElevenLabs عن نموذجين صوتيين جديدين يُسمّيان ElevenLabs v4 وv4 Turbo، بحسب TechCrunch. وتقدّم النسختان الجديدتان تحكماً أكبر في التعبير، وزمن استجابة أقل لعملاء الصوت، ودعماً لأكثر من 90 لغة.

ما الجديد؟

أطلقت الشركة نموذجها v3 في العام الماضي؛ ولجيل v4 اعتمدت بنية جديدة تماماً. ونتيجة لذلك، يمكن للمستخدمين الآن استنساخ صوت باستخدام عينة صوتية مدتها 10 ثوانٍ فقط. ويحافظ النموذج على هوية الصوت بثبات أكبر عبر مقاطع نصية أطول، ويُعدّل التعبير وفق سياق النص أثناء قراءته بصوت عالٍ. كما تم توسيع علامات التعبير المضمّنة التي طُرحت مع v3 في v4، بحيث يمكن للمستخدمين تكديس عدة علامات متتالية.

أي اللغات تحسّنت؟

كان الإصدار السابق يدعم 70 لغة؛ وتقول ElevenLabs إنها رفعت هذا العدد الآن إلى 90. وذكرت الشركة أنها لاحظت أكبر قفزة في الجودة في اليابانية والبرتغالية البرازيلية والماندرين والكانتونية. كما يمكن للنموذج الجديد البدء بتوليد الصوت بمجرد أن يبدأ نموذج اللغة الأساسي بتوليد إجابته، مما يقلّص أوقات الانتظار في مساعدات الصوت.

ماذا يجب أن تفعل فرق المنتجات في تركيا؟

بالنسبة للفرق المتمركزة في تركيا التي تطوّر أتمتة مراكز الاتصال ومنتجات مساعدات الصوت، قد يؤدي انخفاض زمن الاستجابة والاستنساخ من عينة أقصر إلى خفض التكاليف، خصوصاً في سيناريوهات خدمة العملاء متعددة اللغات. ويشير النمو السريع لأعمال الاتصال المؤسسي لدى ElevenLabs إلى أن النماذج المنافسة ستتجه في المسار نفسه؛ ويُنصح الفرق عند اختيار مزوّد صوت بألا تنظر فقط إلى تغطية اللغات، بل أيضاً إلى معايير جودة المحادثة مثل زمن الاستجابة وكيفية التعامل مع المقاطعات.

أسئلة شائعة

كم مقدار الصوت المطلوب لاستنساخ صوت باستخدام v4؟
بحسب ElevenLabs، تتيح البنية الجديدة استنساخ صوت باستخدام عينة صوتية مدتها 10 ثوانٍ فقط.

المصادر

  1. TechCrunch ·

تابع UNIT Journal

مستجدات البحث والذكاء الاصطناعي والتكنولوجيا في موجزك كل يوم.

مقالات ذات صلة

← العودة إلى UNIT Journal

دعنا نقيس
مدى ظهورك اليوم.

نرسم صورة واضحة لظهورك الحالي في البحث ولمكانتك داخل المحركات التوليدية. مجانًا، في صفحة واحدة، وببيانات حقيقية.

اطلب تحليلًا