查看: 5|回复: 0

这看起来有点离谱,但微软真把它做出来了。 100B参数的模型,CPU也能跑。

[复制链接]

14

主题

0

回帖

42

积分

新手上路

积分
42
发表于 昨天 20:51 | 显示全部楼层 |阅读模式
这看起来有点离谱,但微软真把它做出来了。

100B参数的模型,CPU也能跑。

关键不是换了更强的硬件,而是微软的BitNet直接把计算方式改了。

传统LLM大量依赖浮点乘法,BitNet却把权重限制成 -1、0、1。

于是原本复杂的乘法,很多时候直接变成加、减或者跳过。

结果就是:

→ CPU推理最高快约6倍
→ 能耗最高降低82%
→ 模型越大,优势越明显
更狠的是,它不是把普通模型训练完再压缩,而是从训练阶段就采用这种1.58-bit权重。
因为只有3种取值,所以信息密度约为 log₂3 ≈ 1.58 bit。

这东西真正有意思的地方,不是“100B模型能不能跑在CPU上”,而是:

AI算力瓶颈,可能不只靠堆硬件解决。
🔗 https://github.com/microsoft/BitNet




本帖子中包含更多资源

您需要 登录 才可以下载或查看,没有账号?立即注册

×
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

关注公众号

相关侵权、举报、投诉及建议等,请发 E-mail:2776601884@qq.com

Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.|青ICP备2025004122号-1

在本版发帖
关注公众号
返回顶部