# 腾讯混元开源 440MB 翻译模型，手机离线跑，自称翻译质量超谷歌

> 原标题：腾讯混元最新开源：440M翻译模型手机离线就能用，翻译质量超谷歌

- 来源：量子位 · 公众号
- 发布时间：2026-05-02T02:42:00.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/13051
- 原文：https://mp.weixin.qq.com/s?__biz=MzIzNjc1NzUzMw==&mid=2247888083&idx=2&sn=00de0945461f678f57edca79146a4004

## 摘要

腾讯混元放出了一个叫 Hy-MT1.5-1.8B-1.25bit 的翻译模型，把原本 1.8B 参数的模型压到了 440MB，能在骁龙 888、8GB 内存的安卓手机上离线跑。它支持 33 种语言、1056 个翻译方向。压缩的关键是一种叫 Sherry 1.25 比特量化的技术，做法是每 4 个权重里，3 个用 1 比特存，1 个直接置零。官方说翻译质...

## 推荐理由

我会先打个折：这是个垂直翻译模型，不是基础模型大更新，所以没到 P1。但亮点很实在——1.8B 模型压到 440MB，靠的是 1.25-bit Sherry 量化，每 4 个参数里 3 个用 1-bit、1 个直接置零，这种压缩方式少见。正文给了骁龙 888、8GB 内存的离线跑分，不是空口说白话。翻译质量超谷歌这点先别太激动，正文没披露具体测试集和对比条件，但如果是真的，端侧翻译的性价比会明显拉高。

## 锐评

腾讯混元开源了一个翻译模型，把原本18亿参数的模型压缩到440MB，能在骁龙888、8GB内存的安卓手机上离线运行。支持33种语言、1056个翻译方向，覆盖面确实广。压缩用的是Sherry 1.25比特量化技术，简单说就是每4个权重里，3个用1比特存，1个直接扔掉，这样模型体积大幅缩小。官方说翻译质量超过谷歌，但正文没给出具体的评测基准、测试集或延迟数据，只说“翻译质”就断了，信息缺口很大。

这个工作的价值在于让翻译模型真正能在普通手机上离线用，不用联网、不耗流量，对隐私敏感或网络差的场景有用。但“超谷歌”这个说法需要看具体在哪些语言对、什么指标上超，以及是否在同等硬件条件下对比。另外，440MB对手机存储来说不算小，实际下载和加载体验如何也没提。如果后续能补上完整的评测数据和端侧延迟，这个开源才更有说服力。
