লাইভ বক্তৃতায় অনুবাদের বিলম্ব
Qwen3.8-LiveTranslate কথোপকথনকারীর কথা শোনে এবং তিনি কথা বলার সময়ই পাঠ্য ও কণ্ঠে অনুবাদ দেয়। গড় বিলম্ব LAAL মেট্রিক দিয়ে পরিমাপ করা হয়: এটি দেখায়, অনুবাদ মূল বক্তব্যের তুলনায় কতটা পিছিয়ে থাকে।
| LAAL সূচক | মান |
|---|---|
| আগে | 2,8 সেকেন্ড |
| এখন | 2,3 সেকেন্ড |
| পরিবর্তন | প্রায় 18% কম |
Qwen-এর তথ্য অনুযায়ী, নতুন Interleave আর্কিটেকচার অর্থের নির্ভুলতা, অনুবাদের সাবলীলতা ও সংক্ষিপ্ততাও বাড়ায়। ব্যবহারিকভাবে বেছে নেওয়ার মানদণ্ড হলো—কথোপকথনকারী কথা শেষ করার আগেই অনুবাদ পাওয়া গুরুত্বপূর্ণ কি না।
ইনপুট ও ফলাফল
Qwen3.8-LiveTranslate অডিও এবং ঐচ্ছিক ছবি গ্রহণ করে। বক্তব্যের সঙ্গে ভিডিও ফ্রেমও পাঠানো যায়।

আউটপুটে মডেলটি পাঠ্য ও অডিও তৈরি করে। অর্থাৎ, লিখিত অনুবাদ ও কণ্ঠে বলা বক্তব্য—দুটিই একসঙ্গে প্রয়োজন এমন পরিস্থিতির জন্য এর ফরম্যাট উপযুক্ত।
ভাষা ও কথোপকথনের বৈশিষ্ট্য
Qwen3.8-LiveTranslate 60টি ভাষা বোঝে এবং এর মধ্যে 29টিতে কণ্ঠে বলতে পারে। বাকি 31টির ক্ষেত্রে শুধু পাঠ্য অনুবাদ পাওয়া যায়।
মডেলটি একাধিক বক্তার কথোপকথনে বিভিন্ন বক্তাকে শনাক্ত করে এবং তাঁদের কণ্ঠস্বর অক্ষুণ্ণ রাখে। এটি একই সঙ্গে মূল পাঠ্য ও অনুবাদ দেখায় এবং নাম ও পরিভাষার অনুবাদে সামঞ্জস্য রাখতে কথোপকথনের ইতিহাস ব্যবহার করে।
বেছে নেওয়ার মানদণ্ড হলো—প্রয়োজনীয় ভাষাজুটিতে কণ্ঠে বলার সুবিধা আছে কি না এবং একাধিক বক্তাকে নিয়ে কাজ করা দরকার কি না।
সংযোগ
Qwen3.8-LiveTranslate Alibaba Cloud Model Studio এবং QwenCloud-এ WebSocket Realtime API-এর মাধ্যমে ব্যবহার করা যায়। মডেল আইডি হলো qwen3.8-livetranslate-flash-realtime।
ইন্টিগ্রেশনে WebSocket Realtime API এবং এই পরিষেবাগুলোর কোনো একটি ব্যবহার করতে হলে মডেলটি বিবেচনা করা যেতে পারে। উল্লিখিত প্ল্যাটফর্মের বাইরে সংযোগের সুবিধা সম্পর্কে উৎসে কোনো তথ্য দেওয়া নেই।



