跳到正文
原文
腾讯混元 公众号·· 2026-08-26精选AI 评分65

腾讯混元发布 Hy-MT2-1.8B 极低 bit 翻译模型,将 3.3GB 模型压缩至 440MB 并落地直播弹幕

3.3GB 压到 440MB,混元极低 bit 翻译模型跑进直播弹幕

AI 导读

腾讯混元联合英特尔与哔哩哔哩推出 Hy-MT2-1.8B 极低比特翻译模型方案,提供 2-bit(574MB)与 1.25-bit(440MB)两套量化版本,将原本 3.3GB 的端侧模型压缩至几百兆且保持翻译质量几乎无损。

推荐理由

原文展示了从量化算法、芯片指令优化到直播弹幕落地的完整链路,为端侧小模型的极致压缩与低资源部署提供了可复用实践。

来源:腾讯混元 公众号 · mp.weixin.qq.com