当前位置 >  资讯 >  腾讯混元开源手机端离线翻译模型Hy-MT1.5-1.8B

腾讯混元开源手机端离线翻译模型Hy-MT1.5-1.8B

2026-06-25 12:47 天天模拟器

4 月 29 日消息,今日腾讯混元推出了手机端离线翻译模型 Hy-MT1.5-1.8B-1.25bit,并将其开源。这款模型支持 33 种语言的翻译,压缩后体积仅为 440MB,无需连接网络即可在手机本地直接运行,甚至宣称“翻译质量优于谷歌翻译”。

演示设备:高通骁龙 865,8GB 内存。

以下是官方详细介绍:

基于混元翻译大模型 Hy-MT1.5 开发,翻译效果堪比商用翻译模型。

Hy-MT1.5 由腾讯混元团队研发,是一款专业翻译大模型,原生支持 33 种语言、5 种方言或民汉语言,以及 1056 个翻译方向。无论是常见的中英互译,还是法语、日语、阿拉伯语、俄语,甚至藏语、蒙古语等少数民族语言,它都能自如应对。

仅凭 1.8B 的参数量,Hy-MT1.5 实现了与商业翻译 API 和 235B 级大模型相媲美的翻译效果。在严格的评估基准测试中,其翻译质量不仅超越了谷歌翻译等主流系统,还证明了在高效优化下,轻量级模型能够展现出令人惊叹的翻译能力。

Hy-MT1.5-1.8B 翻译效果评分详情可见文末链接中的 Hy-MT1.5 技术报告。

但问题在于:原始的 1.8B 模型即使在 FP16 精度下,也需要占用 3.3GB 内存。对于手机上宝贵的内存资源来说,这依然显得过大且速度较慢,因此需要进行量化压缩。

极致的量化压缩,将模型装入手机。

量化压缩,简而言之,就是将模型中原本用 16 位数字(16-bit)表示的参数转换为更低位数的数字进行存储。这类似于将一张高清照片压缩成缩略图,文件体积大幅减小,但内容依然清晰可辨。针对不同手机用户,腾讯特别推出了 2-bit 与 1.25-bit 两种极致的量化压缩方案。

不同大小模型在 FLORES-200 中外互译的效果评分。2-bit 模型:性能与质量的平衡,适用于中高端机型。

2-bit 模型采用了业界领先的拉伸弹性量化技术(SEQ),将模型参数量化为 -1.5、-0.5、0.5、1.5 四个值,并结合量化感知蒸馏技术。在将模型体积压缩至 574MB 的同时,实现了近乎无损的翻译质量,效果甚至超越了许多上百 GB 的大模型。在支持 Arm SME2 技术的移动设备上,2-bit 模型能够实现更快速、更高效的推理。

2-bit 模型在 SME2 及 Neon 内核的速度对比演示。1.25-bit 模型:Sherry 极致压缩,适用于全系机型。

为了达到极致的轻量化,腾讯推出了基于 Sherry 稀疏高效三值量化技术的 1.25-bit 模型。该技术方案已被 NLP 顶级学术会议 ACL 2026 收录。

链接: abs/2。

Sherry 压缩方案的核心逻辑在于“细粒度稀疏”策略:每 4 个模型参数中,3 个最重要的参数用 1-bit 存储,1 个参数用 0 存储,平均每个参数仅需 1.25-bit。

配合腾讯专为手机 CPU 设计的 STQ 内核,该方案完美适配了 SIMD 指令集。最终,3.3GB 的原始模型被进一步压缩至 440MB,可轻松常驻后台,让内存紧张的普通手机也能流畅进行高质量的离线翻译。

FP16 八倍速 vs 1.25bit 速度对比,演示设备:高通骁龙 888,8GB 内存。

实际体验:全离线、零成本、零隐私泄露。

本次开源不仅包含模型权重,还特别制作了一个实用的腾讯混元翻译 Demo 版,并适配了“后台取词模式”。无论是在本地查看邮件还是浏览网页,混元翻译都能随时响应。无需网络、无需订阅,完全本地处理,不涉及个人信息的采集与上传,一次下载即可永久使用!

演示设备:高通骁龙 7+gen2,16GB 内存。

立即体验。

所有模型权重、代码及技术报告已全面开源。现阶段仅支持安卓体验 Demo,后续正式版将增加对 iOS 等平台的支持。

体验链接:

Huggingface海外用户:: AngelSlim / Hy-MT1.5-1.8B-1.25bit-GGUF / resolve / main /

魔搭社区国内用户: models / AngelSlim / Hy-MT1.5-1.8B-1.25bit-GGUF / resolve / master /

模型下载

1、Huggingface海外用户:

2-bit 模型权重: AngelSlim / Hy-MT1.5-1.8B-2bit

2-bit 模型 gguf: AngelSlim / Hy-MT1.5-1.8B-2bit-GGUF

1.25-bit 模型权重: AngelSlim / Hy-MT1.5-1.8B-1.25bit

1.25-bit 模型 gguf: AngelSlim / Hy-MT1.5-1.8B-1.25bit-GGUF

2、魔搭社区国内用户:

2-bit 模型权重: models / AngelSlim / Hy-MT1.5-1.8B-2bit

2-bit 模型 gguf: models / AngelSlim / Hy-MT1.5-1.8B-2bit-GGUF

1.25-bit 模型权重: models / AngelSlim / Hy-MT1.5-1.8B-1.25bit

1.25-bit 模型 gguf: models / AngelSlim / Hy-MT1.5-1.8B-1.25bit-GGUF

3、技术报告:

Sherry 论文地址: abs/2

AngelSlim 技术报告: abs/3

Hy-MT1.5 技术报告: abs/2

4、代码仓库:

AngelSlim:

来源:IT之家

文章图片应用自网络,如有侵权请联系删除。
最新资讯 更多
最新合集 更多