Qwen 发布实时同传模型,延迟压到 2.3 秒,能分清谁在说话
Qwen 发布 Qwen3.8-LiveTranslate 实时同传模型,LAAL 降至 2.3 秒
Qwen3.8-LiveTranslate 把同声传译的延迟从上一代的 2.8 秒降到了 2.3 秒。它用了一种叫“交错架构”的方法,把音频和文字编成一条流,让模型边听边译,已经翻译过的内容可以缓存复用,所以质量比上一代有明显提升。这个模型支持 60 种语言的语音输入,新增了三个实用能力:一是实时区分说话人,多人轮流发言时能标出每句话是谁说的,并且克隆...
推荐理由:Qwen这次把同传延迟从2.8秒砍到2.3秒,靠的是交错架构和缓存复用,不是单纯堆算力。新增的说话人区分、声音克隆和双语字幕让模型从“翻译”往“场景理解”迈了一步。正文只给了官方博客,没有第三方评测或实际部署数据,所以分数没往上拉。对需要低延迟翻译的场景,这模型确实实用,但效果还得等更多人跑过才知道。