रीयल-टाइम भाषण अनुवाद में विलंब
Qwen3.8-LiveTranslate वक्ता को सुनता है और उसके बोलते समय पाठ और आवाज़ के रूप में अनुवाद देता है। औसत विलंब का आकलन LAAL मेट्रिक से किया जाता है: यह दिखाता है कि अनुवाद मूल भाषण से कितना पीछे है।
| LAAL मेट्रिक | मान |
|---|---|
| पहले | 2,8 सेकंड |
| अब | 2,3 सेकंड |
| बदलाव | लगभग 18% कम |
Qwen के अनुसार, नया Interleave आर्किटेक्चर अर्थ की सटीकता, अनुवाद की प्रवाहशीलता और संक्षिप्तता भी बढ़ाता है। चुनने का व्यावहारिक मानदंड यह है कि क्या वक्ता के बोलना समाप्त करने से पहले अनुवाद मिलना ज़रूरी है।
इनपुट और परिणाम
Qwen3.8-LiveTranslate ऑडियो और वैकल्पिक छवियाँ स्वीकार करता है। वीडियो फ़्रेम को भाषण के साथ भेजा जा सकता है।

आउटपुट में मॉडल पाठ और ऑडियो तैयार करता है। इसलिए इसका फ़ॉर्मैट उन परिदृश्यों के लिए उपयुक्त है जहाँ लिखित अनुवाद और बोला हुआ अनुवाद, दोनों चाहिए।
भाषाएँ और बातचीत की सुविधाएँ
Qwen3.8-LiveTranslate 60 भाषाएँ समझता है और उनमें से 29 में आवाज़ के साथ अनुवाद दे सकता है। बाकी 31 भाषाओं के लिए केवल पाठ अनुवाद उपलब्ध है।
मॉडल कई लोगों की बातचीत में अलग-अलग वक्ताओं को पहचानता है और उनकी आवाज़ें बरकरार रखता है। यह मूल पाठ और अनुवाद को साथ-साथ दिखाता है और नामों तथा शब्दावली का अनुवाद एकसमान रखने के लिए बातचीत के इतिहास का उपयोग करता है।
चुनने का मानदंड यह है कि क्या ज़रूरी भाषा-युग्म में आवाज़ के साथ अनुवाद उपलब्ध है और क्या कई वक्ताओं के साथ काम करना आवश्यक है।
कनेक्शन
Qwen3.8-LiveTranslate, Alibaba Cloud Model Studio और QwenCloud पर WebSocket Realtime API के ज़रिए उपलब्ध है। मॉडल आइडेंटिफ़ायर है qwen3.8-livetranslate-flash-realtime।
इस मॉडल पर तब विचार करें, जब इंटीग्रेशन में WebSocket Realtime API और इन सेवाओं में से किसी एक का उपयोग होना हो। बताए गए प्लेटफ़ॉर्म के अलावा अन्य माध्यमों से कनेक्शन की संभावनाओं का स्रोतों में वर्णन नहीं है।



