1.8B 参数,33 种语言互译,还能塞进 llama.cpp。腾讯这回没先甩 70B,先把翻译模型做成能塞进笔记本的东西。 小楚 2026-09-13 22:10:52 1.8B 参数,33 种语言互译,还能塞进 llama.cpp。腾讯这回没先甩 70B,先把翻译模型做成能塞进笔记本的东西。 Hy-MT2-1.8B-GGUF 能跟术语、文风、JSON/字幕这类结构化指令。官方说小模型综合表现能打过部分商用翻译 API;再压到 1.25-bit 大约 440MB。系列还有 7B 和 30B-A3B。 坑:官方 GGUF 依赖 llama.cpp 的 STQ kernel(PR #22836),随便下一个量化不一定能跑。 🔗https://huggingface.co/tencent/Hy-MT2-1.8B-GGUF… Apache-2.0。厂商榜单归厂商,自己丢一段字幕试试。