Qwen3.8-LiveTranslate memproses ucapan dengan latensi rata-rata 2,3 detik

30 September 202610 tampilan

Model berbasis arsitektur Interleave mengenali 60 bahasa, menghasilkan audio dalam 29 bahasa, dan mendukung penerjemahan selama percakapan. Artikel ini membahas pengurangan latensi rata-rata, pemisahan ujaran berdasarkan suara, output dwibahasa, serta akses melalui API Alibaba Cloud dan QwenCloud.

Qwen3.8-LiveTranslate memproses ucapan dengan latensi rata-rata 2,3 detik

Latensi penerjemahan dalam percakapan

Qwen3.8-LiveTranslate mendengarkan lawan bicara dan menghasilkan terjemahan dalam bentuk teks dan suara saat mereka berbicara. Rata-rata keterlambatan diukur dengan metrik LAAL: metrik ini menunjukkan seberapa jauh terjemahan tertinggal dari ucapan asli.

Metrik LAALNilai
Sebelumnya2,8 detik
Sekarang2,3 detik
Perubahanberkurang sekitar 18%

Menurut Qwen, arsitektur Interleave yang baru juga meningkatkan akurasi penyampaian makna, kelancaran, dan keringkasan terjemahan. Kriteria praktis untuk memilihnya adalah apakah terjemahan perlu tersedia sebelum lawan bicara selesai berbicara.

Input dan hasil

Qwen3.8-LiveTranslate menerima audio dan gambar opsional. Bingkai video dapat dikirim bersama ucapan.

Model menghasilkan teks dan audio. Artinya, formatnya cocok untuk skenario yang membutuhkan terjemahan tertulis sekaligus ucapan yang dihasilkan.

Bahasa dan fitur percakapan

Qwen3.8-LiveTranslate memahami 60 bahasa dan dapat menghasilkan ucapan dalam 29 di antaranya. Untuk 31 bahasa lainnya, hanya tersedia terjemahan teks.

Model mengenali pembicara yang berbeda dalam percakapan multipihak dan mempertahankan suara mereka. Model juga menampilkan teks asli dan terjemahan secara sinkron, serta menggunakan riwayat percakapan untuk menerjemahkan nama dan istilah secara konsisten.

Kriteria pemilihannya adalah apakah pasangan bahasa yang dibutuhkan mendukung keluaran suara dan apakah diperlukan dukungan untuk beberapa pembicara.

Integrasi

Qwen3.8-LiveTranslate tersedia melalui WebSocket Realtime API di Alibaba Cloud Model Studio dan QwenCloud. ID modelnya adalah qwen3.8-livetranslate-flash-realtime.

Model ini layak dipertimbangkan jika integrasi harus menggunakan WebSocket Realtime API dan salah satu layanan tersebut. Sumber yang tersedia tidak menjelaskan opsi integrasi di luar platform tersebut.

Pertanyaan yang sering ditanyakan

Bahan terkait

Semua bahan
Qwen3.8-LiveTranslate memproses ucapan dengan latensi rata-rata 2,3 detik