Qwen3.8-LiveTranslate procesa el habla con un retraso medio de 2,3 segundos

30 septiembre 202610 vistas

El modelo basado en la arquitectura Interleave reconoce 60 idiomas, habla 29 y admite la traducción durante la conversación. El artículo aborda la reducción del retraso medio, la separación de intervenciones por voz, la salida bilingüe y el acceso a través de las API de Alibaba Cloud y QwenCloud.

Qwen3.8-LiveTranslate procesa el habla con un retraso medio de 2,3 segundos

Retraso de la traducción durante el habla

Qwen3.8-LiveTranslate escucha al interlocutor y ofrece una traducción en texto y voz mientras este habla. El retraso medio se estima con la métrica LAAL, que muestra cuánto se queda la traducción por detrás del habla original.

Indicador LAALValor
Antes2,8 segundos
Ahora2,3 segundos
Cambioaproximadamente un 18 % menos

Según Qwen, la nueva arquitectura Interleave también mejora la precisión en la transmisión del significado, la fluidez y la concisión de la traducción. El criterio práctico para elegirla es si es importante recibir la traducción antes de que el interlocutor termine de hablar.

Datos de entrada y resultados

Qwen3.8-LiveTranslate acepta audio e imágenes opcionales. Se pueden enviar fotogramas de vídeo junto con el habla.

El modelo genera texto y audio. Por tanto, su formato es adecuado para situaciones en las que se necesitan tanto una traducción escrita como un discurso hablado.

Idiomas y funciones de conversación

Qwen3.8-LiveTranslate entiende 60 idiomas y puede generar voz en 29 de ellos. Para los otros 31 solo está disponible la traducción de texto.

El modelo reconoce a distintos hablantes en conversaciones grupales y conserva sus voces. También muestra el texto original y la traducción de forma sincronizada, y utiliza el historial de la conversación para traducir nombres y términos de forma coherente.

El criterio para elegirla es si admite locución para el par de idiomas necesario y si se requiere trabajar con varios hablantes.

Conexión

Qwen3.8-LiveTranslate está disponible a través de WebSocket Realtime API en Alibaba Cloud Model Studio y QwenCloud. El identificador del modelo es qwen3.8-livetranslate-flash-realtime.

Conviene considerar el modelo si la integración debe utilizar WebSocket Realtime API y uno de estos servicios. Las fuentes no describen las opciones de conexión fuera de las plataformas mencionadas.

Preguntas frecuentes

Material similar

Todos los materiales
Qwen3.8-LiveTranslate procesa el habla con un retraso medio de 2,3 segundos