沽上行走的人 发表于 昨天 11:22

转:从H200到GB300,真实Agent工作负载的吞吐量提升了最高30倍,成本大致翻倍。

转:从H200到GB300,真实Agent工作负载的吞吐量提升了最高30倍,成本大致翻倍。

从GB300到Vera Rubin,吞吐量再次飙升最高30倍,整机架价格大致再翻倍。

按照老黄的摩尔定律,合着这两年英伟达最大的技术突破不是GPU本身,而是让价格贵了4倍,却换来了整整900倍的速度飞跃!

大模型时代,英伟达靠GPU拿下训练和推理。

Agent时代,它的版图已经延伸到CPU、推理加速器、NVLink等等。

老黄卖的,早已不只是一块GPU。

他要卖的,是一座可以不断生产Token的AI工厂。

老黄这一次,是要给整个「Agent时代」重新铺一遍地基。

页: [1]
查看完整版本: 转:从H200到GB300,真实Agent工作负载的吞吐量提升了最高30倍,成本大致翻倍。