يعالج Qwen3.8-LiveTranslate الكلام بمتوسط زمن تأخير يبلغ 2.3 ثانية

30 سبتمبر 202610 الآراء

يتعرّف النموذج القائم على بنية Interleave على 60 لغة، وينطق 29 لغة، ويدعم الترجمة أثناء المحادثة. يتناول المقال تقليل متوسط التأخر، وفصل المداخلات حسب الأصوات، والإخراج ثنائي اللغة، والوصول عبر واجهتَي API في Alibaba Cloud وQwenCloud.

يعالج Qwen3.8-LiveTranslate الكلام بمتوسط زمن تأخير يبلغ 2.3 ثانية

تأخر الترجمة أثناء تدفق الكلام

يستمع Qwen3.8-LiveTranslate إلى المتحدث ويقدّم الترجمة نصًا وصوتًا أثناء حديثه. يُقاس متوسط التأخر بمقياس LAAL، الذي يبيّن مدى تأخر الترجمة عن الكلام الأصلي.

مقياس LAALالقيمة
سابقًا2,8 ثانية
الآن2,3 ثانية
التغييرأقل بنحو 18%

وفقًا لـ Qwen، تحسّن بنية Interleave الجديدة أيضًا دقة نقل المعنى وسلاسة الترجمة وإيجازها. والمعيار العملي للاختيار هو أهمية تلقي الترجمة قبل أن ينتهي المتحدث من كلامه.

المدخلات والمخرجات

يقبل Qwen3.8-LiveTranslate الصوت والصور الاختيارية. ويمكن إرسال إطارات الفيديو مع الكلام.

ينشئ النموذج نصًا وصوتًا في المخرجات. وهذا يعني أن تنسيقه مناسب للسيناريوهات التي تتطلب ترجمة مكتوبة وكلامًا منطوقًا في الوقت نفسه.

اللغات ووظائف المحادثة

يفهم Qwen3.8-LiveTranslate 60 لغة، ويمكنه نطق 29 منها. أما اللغات الـ31 الأخرى، فتتوفر لها الترجمة النصية فقط.

يتعرّف النموذج على المتحدثين المختلفين في المحادثات متعددة الأطراف ويحافظ على أصواتهم. كما يعرض النص الأصلي والترجمة بالتزامن، ويستخدم سجل المحادثة لضمان اتساق ترجمة الأسماء والمصطلحات.

ومعيار الاختيار هو ما إذا كان زوج اللغات المطلوب يدعم النطق، وما إذا كانت هناك حاجة إلى العمل مع عدة متحدثين.

الربط

يتوفر Qwen3.8-LiveTranslate عبر WebSocket Realtime API على Alibaba Cloud Model Studio وQwenCloud. ومعرّف النموذج هو qwen3.8-livetranslate-flash-realtime.

يجدر النظر في النموذج إذا كان التكامل يتطلب استخدام WebSocket Realtime API وإحدى هاتين الخدمتين. ولا تتناول المصادر إمكانات الربط خارج المنصات المذكورة.

الأسئلة المتكررة

المواد ذات الصلة

جميع المواد
يعالج Qwen3.8-LiveTranslate الكلام بمتوسط زمن تأخير يبلغ 2.3 ثانية