查看: 5|回复: 0

1.8B 参数,33 种语言互译,还能塞进 llama.cpp。腾讯这回没先甩 70B,先把翻译模型做成能塞进笔记本的东西。

[复制链接]

18

主题

0

回帖

54

积分

注册会员

积分
54
发表于 昨天 22:10 | 显示全部楼层 |阅读模式
1.8B 参数,33 种语言互译,还能塞进 llama.cpp。腾讯这回没先甩 70B,先把翻译模型做成能塞进笔记本的东西。

Hy-MT2-1.8B-GGUF 能跟术语、文风、JSON/字幕这类结构化指令。官方说小模型综合表现能打过部分商用翻译 API;再压到 1.25-bit 大约 440MB。系列还有 7B 和 30B-A3B。

坑:官方 GGUF 依赖 llama.cpp 的 STQ kernel(PR #22836),随便下一个量化不一定能跑。

🔗https://huggingface.co/tencent/Hy-MT2-1.8B-GGUF

Apache-2.0。厂商榜单归厂商,自己丢一段字幕试试。

本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

关注公众号

相关侵权、举报、投诉及建议等,请发 E-mail:2776601884@qq.com

Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.|青ICP备2025004122号-1

在本版发帖
关注公众号
返回顶部