跳到正文
腾讯混元· 腾讯混元·· 2026-08-26精选AI 评分79

混元发布极低 bit 翻译模型,压缩至 440MB 并落地直播弹幕

3.3GB 压到 440MB,混元极低 bit 翻译模型跑进直播弹幕

AI 导读

腾讯混元将 Hy-MT2-1.8B 翻译模型通过 2-bit 和 1.25-bit 方案压缩至几百 MB,翻译质量几乎无损,并联合英特尔完成 x86 适配、联合哔哩哔哩在直播弹幕实时翻译中落地。1.25-bit 模型基于 Sherry 技术,体积从 3.3GB 压至 440MB,B 站演示中单条弹幕翻译耗时 500~800ms,内存占用 500~700MB。

推荐理由

混元将翻译模型量化至1.25-bit并落地B站直播,展示了极低比特压缩在端侧高并发场景的可用性。

来源:腾讯混元 · mp.weixin.qq.com