腾讯混元 公众号·· 2026-08-26精选AI 评分65
腾讯混元发布 Hy-MT2-1.8B 极低 bit 翻译模型,将 3.3GB 模型压缩至 440MB 并落地直播弹幕
3.3GB 压到 440MB,混元极低 bit 翻译模型跑进直播弹幕
AI 导读
腾讯混元联合英特尔与哔哩哔哩推出 Hy-MT2-1.8B 极低比特翻译模型方案,提供 2-bit(574MB)与 1.25-bit(440MB)两套量化版本,将原本 3.3GB 的端侧模型压缩至几百兆且保持翻译质量几乎无损。
推荐理由
原文展示了从量化算法、芯片指令优化到直播弹幕落地的完整链路,为端侧小模型的极致压缩与低资源部署提供了可复用实践。
来源:腾讯混元 公众号 · mp.weixin.qq.com