Qwen, 실시간 통역 모델 공개

Qwen이 9월 18일 실시간 동시통역 모델 Qwen3.8-LiveTranslate를 공개했다. Qwen 공식 발표에 따르면 새 모델은 음성과 텍스트를 하나의 시계열로 엮는 인터리브(Interleave) 구조를 적용해 이전 세대보다 번역 충실도·유창성·간결성을 높였으며, 평균 지연시간(LAAL)은 2.8초에서 2.3초로 줄였다.

Qwen3.8-LiveTranslate는 60개 언어를 지원한다. 여러 화자를 실시간으로 구분해 문장별 발화자를 표시하고, 번역 음성에 각 화자의 음색을 더 안정적으로 반영한다. 원문과 번역문을 한 화면에 동기화해 보여주며, 앞선 대화와 텍스트를 활용해 고유명사와 지시어, 전문용어의 모호성도 줄인다.

구조는 하이브리드 전문가 혼합(Hybrid-MoE) 기반의 ‘Thinker–Talker’ 두 모듈로 구성된다. Thinker가 영상·음성·원문·번역을 시간순 단일 시퀀스로 처리하면, Talker가 번역문과 원 음성을 결합해 화자의 음색을 보존한 음성을 합성한다.

Qwen은 14개 언어 방향을 포함한 Omnilingua-MSpeaker와 70개 언어 방향의 FLEURS 평가에서 기존 세대와 주요 실시간 통역 시스템을 앞섰다고 밝혔다. 다만 공개 자료에는 비교 시스템별 세부 점수가 제시되지 않았다.

반응 확인 중

읽기 목록은 이 브라우저에 저장됩니다.

출처

  1. Qwen3.8-LiveTranslate: Names the speaker. Carries the meaning. — Qwen 공식 연구·발표 · 자료: 2026. 9. 18.

이 글은 위 출처를 근거로 자동 생성된 뒤 발행됐습니다. 원문을 함께 확인해 주세요. 교차 보도 없이 단독 출처로 작성됐습니다.