ithome
科技
采集 2026-09-19T10:11:30+00:00
阿里千问发布同声传译大模型Qwen3.8-LiveTranslate
原始标题:阿里千问发布同声传译大模型 Qwen3.8-LiveTranslate,支持原文译文同帧同出
来源
ithome
发布时间
2026-09-19T07:14:27
采集批次
2026-09-19-10
字数
630
URL 指纹
64f8faae46843b3f
📌 AI 总结(220 字)
阿里千问发布同声传译大模型Qwen3.8-LiveTranslate,采用Interleave架构重构实时同传,字均延迟从2.8秒降至2.3秒。文章介绍了该模型的三大新能力:实时说话人分离、长上下文消歧和基于Hybrid MoE的Thinker–Talker双模块设计,实现原文译文同帧同出。模型支持60种语言,在Omnilingua-MSpeaker和FLEURS评测集的翻译质量、延迟、语音识别与合成等维度上均优于当前主流实时同传系统。
📄 正文(630 字)
IT之家9月19日消息,阿里千问今日发布同声传译大模型Qwen3.8-LiveTranslate,模型以Interleave架构重构实时同传,准确度、流畅度、简洁度全面提升,字均延迟(LAAL)从2.8秒降至2.3秒。 官方表示,在支持60种语言的基础上,Qwen3.8-LiveTranslate新增三项能力让同传更广泛地应用于真实场景中:实时说话人分离,每句话归属清晰,音色复刻更稳定;长上下文消歧,联系前文读懂当下,人名术语翻译更精准。 Qwen3.8-LiveTranslate采用基于Hybrid MoE的Thinker–Talker双模块设计,通过Interleave方式衔接流式理解、文本输出与语音生成。其中,Thinker把视频、音频、原文与译文编排进同一条因果序列,按时序交替排列、端到端产出,让理解与翻译在单一序列内完成;Talker再结合译文和源音频,把译文合成为保留原说话人音色的译文语音。 在覆盖14个语向的多说话人长音频评测集Omnilingua-MSpeaker上,Qwen3.8-LiveTranslate在翻译的忠实度、流畅度、简洁度以及说话人识别的错误率DER四个维度上均优于目前行业主流实时同传系统。 官方在公开FLEURS音频测试集上评测了70个语言方向的实时同传表现。Qwen3.8-LiveTranslate在翻译质量、字均延迟、语音识别准确率以及语音合成质量四个维度上领先于上一代以及当前主流实时同传系统。