隐藏置顶帖
置顶
一起港湾 (17GW.com) 论坛发帖须知
欢迎来到 一起港湾 (17GW) 社区!这里是 AI 技术爱好者、数码极客和生活分享者的精神家园。为了维护港湾的纯净秩序与技术氛围,请在开启您的分享之旅前,仔细阅读并遵守以下发帖规范。
一、 核心发帖准则
[*]主题契合,精准归类:请确保内容与所属版块(如 AI 技术、数码维修、资源分享等)相关。标题应简明扼要,避免“ ...
这将是终极版 Mac Pro:采用今天早些时候泄露的苹果私有云计算服务器架构,并将其缩小到桌面工作站的体积。
这将是终极版 Mac Pro:采用今天早些时候泄露的苹果私有云计算服务器架构,并将其缩小到桌面工作站的体积。
- 最多可配备 4 个计算单元,每个单元都位于独立的扩展卡上,搭载 M5 Pro 或 M5 Max 处理器
- 每个计算单元配备 32GB、64GB 或 128GB 统一内存
- 每个计算单元配备一块 SSD,主板上还可选配 2 块 SSD
- 计算单 ...
GPU霸权将被超大内存架构取代,AI芯片迎来内存革命!
【GPU霸权将被超大内存架构取代,AI芯片迎来内存革命!】
AI芯片的技术演进正站在重大拐点之上 。
被誉为“HBM之父”的韩国科学技术院电气与电子工程学院教授金正浩近日公开表示,未来AI算力体系将发生结构性重构——主导权正从处理器转向内存 。
目前以英伟达GPU和通用CPU为核心的计算范式,将在中长期被一种全新的内 ...
#英特尔CPU进入英伟达新一代旗舰主机#
【#英特尔CPU进入英伟达新一代旗舰主机#】
圣何塞举办的NVIDIA GTC 2026大会上,Intel正式宣布一项重磅合作,其Xeon 6(至强6)处理器将成为NVIDIA下一代旗舰AI服务器系统DGX Rubin NVL8的主机CPU。据悉,DGX Rubin NVL8是NVIDIA新一代旗舰AI服务器系统,主打智能体AI和推理系统等新兴应用场景。在这套系统中,主机CPU的作 ...
字节跳动PICOOS6预告发布#,今年还将推出全新 XR 旗舰产品“Project Swan
【#字节跳动PICOOS6预告发布#,今年还将推出全新 XR 旗舰产品“Project Swan”】字节跳动 PICO-XR 官方今日正式预告了下一代空间操作系统 —— PICO OS 6,并宣布将在 2026 年推出全新 XR 旗舰产品 —— Project Swan(内部代号)。 ##
...
intel 显卡现在对 AI 的支持怎么样了?
看到 pytorch 2.5 正式支持 intel 了,但是搜了下没看到太多讨论,有用过的分享一下使用体验吗?
主要是眼馋显存,想买个来玩玩 AI 绘图,训练 lora 啥的
不想把 AI 和数据交给云厂商,也不想折腾复杂部署?
New
不想把 AI 和数据交给云厂商,也不想折腾复杂部署?
Olares 提供了一种本地 AI 云方案:把计算、存储和应用管理放回自己的硬件上。
它支持:
一键部署本地 AI 模型
GPU 资源自动调度
搭建私有知识库
应用沙箱隔离
统一管理存储、数据库和备份
多设备访问与统一登录
底层把 Kubernetes 等复杂基础设施封装起来,让自托管 ...
显存就这么多,怎么把字吐得更快?——从 MoE、KV Cache 到 DFlash 的本地部署全景拆解
New
“一张 16GB 显卡,也能跑 27B 大模型。”
看到这句话,先别急着下载权重。
你还需要知道:用了什么量化?上下文开了多长?模型是否全部放在显存里?所谓“快”,指开始回答快,还是回答时每秒生成的 token 多?
这些条件不同,“能跑”的含义可能相差很大。模型成功加载,只是第一步;能读完你的材料、给出可靠答案,并 ...
在着手编写这本手册之前,我自以为理解了 GPU 利用率的概念。
New
在着手编写这本手册之前,我自以为理解了 GPU 利用率的概念。
我曾一度将三个截然不同的概念混为一谈:内核(kernel)启动的任务、实际驻留在 GPU 上的任务,以及当前准备好发射(issue)的任务。它们并非同一回事。
以一个包含 240 个线程块(block)、每个块 256 个线程的内核为例。这意味着共有 61,440 个逻辑线程,即 ...
有本事就来拿 未经注册的算力全天候运行着非法的中国产“叮当响”机器
New
有本事就来拿
未经注册的算力全天候运行着非法的中国产“叮当响”机器
有本事就来拿
New
这是我做过的最棒的投资和押注。
New
在 2023/2024 年做这件事简直是疯狂且愚蠢的,但我当时坚信本地运行的 AI 和开源 AI 代表着未来。
这是我做过的最棒的投资和押注。
华硕刚刚发布了迄今为止最小的AI工作站。
华硕刚刚发布了迄今为止最小的AI工作站。
ProArt GR1X搭载NVIDIA RTX Spark显卡,配备:
• 128GB统一显存
• Blackwell GPU(6144个CUDA核心)
• 20核Grace CPU
• 10GbE + Wi-Fi 7
• 最高1 PFLOP FP4 AI性能
• 全天候双风扇散热
这款150mm迷你PC专为运行高达1200亿参数的本地AI模型而设计。
...
破案了,这次 ChatGPT 6 Astra 惊艳的表现,背后传言的那 10 万台顶级 AI 训练芯片,确定是英伟达最新一代 Grace Blackwell,而黄仁勋多写的那句 NVLink72,等于把机型系统也点名了。
破案了,这次 ChatGPT 6 Astra 惊艳的表现,背后传言的那 10 万台顶级 AI 训练芯片,确定是英伟达最新一代 Grace Blackwell,而黄仁勋多写的那句 NVLink72,等于把机型系统也点名了。NVLink72 是一套把一个机柜里,大约 72 张英伟达 Blackwell GPU,用超高带宽连成一块大整机,按 OpenAI 这次需求,再把很多这样的机柜,拼 ...
属于硬件垃圾佬的参考方案又来了 直接u盘部署agent,走到哪插到哪
属于硬件垃圾佬的参考方案又来了
直接u盘部署agent,走到哪插到哪
感觉可以拿着开源的项目,二开,然后出去卖u盘
甚至可以在底层文件里写入自己的中转站
想用是吧?
按月给我的平台交钱
满满的套路来了啊~
地址依然评论区
...
发现一个挺有意思的开源项目:Kindle Dashboard,专门拯救吃灰的老 Kindle。
发现一个挺有意思的开源项目:Kindle Dashboard,专门拯救吃灰的老 Kindle。
能直接改造成一块超省电的电子墨水屏信息板,用来显示天气、日历股票行情之类的信息都很合适。
而且电子墨水屏长时间显示几乎不耗电,挂桌上当常驻 Dashboard,反而比吃灰有意思多了。
https://github.com/alexishida/kindle-dashboard
...
把 Cloudflare Workers 整套平台能力装进单个二进制文件,让你在自己的机器上原样运行 Workers 应用,无需账号和云厂商。
把 Cloudflare Workers 整套平台能力装进单个二进制文件,让你在自己的机器上原样运行 Workers 应用,无需账号和云厂商。
https://github.com/elliothux/open-compute
过去十年 AI 硬件的演进史,本质是一部通用算力的自杀史:
过去十年 AI 硬件的演进史,本质是一部通用算力的自杀史:
从什么逻辑都能跑的 CPU,到数千核并行的 GPU,
再到波浪式流动的 TPU,以及边缘低功耗的 NPU,
直到最后连内存都不要的 LPU,
你得到的每一毫秒延迟降低,都是拿芯片的通用寿命换来的。
所以大家也别再以为 AI 算力竞争只是在拼谁的跑分更高,
把 CPU、GPU、TPU、NPU 和 ...
OpenAI买了几万台苹果Mac,专门搞强化学习
【OpenAI买了几万台苹果Mac,专门搞强化学习】据量子位,OpenAI已购买数以万计的Mac mini和Mac Studio用于强化学习,Anthropic也通过AWS租Mac mini做类似任务。
这些Mac用来训练"计算机使用智能体",能自主操作电脑完成编辑测试代码、整理邮箱、总结文档等多步骤任务。
AI训练长期由英伟达GPU主导,但Mac能在强化学习被 ...
Mac mini其实应用范围真的不广…除去本体屏幕、键盘、鼠标加起来也得2K
Mac mini其实应用范围真的不广…除去本体屏幕、键盘、鼠标加起来也得2K
之前M4的Mac mini爆火是因为最低2开头的价格不仅是对于手上已经有一套屏幕键盘鼠标的人群,哪怕是在花2K买一套,哪怕是算上二手,M4 Mac mini依旧是苹果最佳入门性价比产品,但是现在的M6 Mac mini 7K的价位[捂嘴哭]这价格你去买个二手M4 MacBook不是 ...
748GB统一内存107万元!NVIDIA奢华工作站陆续开卖
6月初的Computex 2026大展上,,配备GB300超级芯片和748GB统一内存,合作品牌包括华硕、戴尔、技嘉、微星、超微、惠普。GB300超级芯片分为Blackwell Ultra GPU(20480核心)、Grace CPU(72核心Arm架构)两部分,FP4精度稀疏算力高达20PFlops(2亿亿次每秒),FP8精度下也有10PFlops(1亿亿次每秒)。CPU搭配了496GB LPDDR5 ...