订阅

AI 评测与前沿 今日: 0|主题: 220|排名: 24 

  • Grok 4.20也发布了。Musk特意强调了其“美式价值观对齐”特性[doge] ​​​
    Grok 4.20也发布了。Musk特意强调了其“美式价值观对齐”特性[doge] ​​​
    0406 莳玫 发表于 2026-2-18 AI 评测与前沿
  • 马斯克官宣 Grok 4.2 公开测试版上线,具备快速学习能力
    感谢网友 Nuc_F 的线索投递! 2 月 18 日消息,今日特斯拉、X 平台 CEO 埃隆 · 马斯克通过 X 平台发文官宣,xAI 旗下大模型 Grok 的 4.2 版本候选发布版(公开测试版)现已可供使用。注意到,这位全球首富在 X 平台上写道,用户必须专门选择 Grok 4.2 才能激活它。马斯克在推文中表示,非常欢迎用户为该版本提供反馈。他同 ...
    0413 joep 发表于 2026-2-18 AI 评测与前沿
  • 当AI开始设计制造AI的芯片,我们正在见证什么
    【当AI开始设计制造AI的芯片,我们正在见证什么】 英伟达宣布向全公司约三万名工程师部署 OpenAI Codex。这个数字本身就是一个信号:当全球最重要的AI芯片公司选择让AI来写代码,某种临界点正在被跨越。 有人说这是利益绑定的结果,毕竟英伟达在 OpenAI、Anthropic、xAI 等公司都投了至少十亿美元。但更值得玩味的是另一 ...
    0429 蕙心纨质 发表于 2026-2-17 AI 评测与前沿
  • Paul Graham 和 OpenAI 联合创始人Greg Brockman 最近都在猛推品味(Taste)。
    Paul Graham 和 OpenAI 联合创始人Greg Brockman 最近都在猛推品味(Taste)。 确实,随着大模型越来越强大,生成门槛也会彻底消失,“品味”或许才是真实护城河。 我把这种 Taste 理解成一种极度稀缺的高阶判断力,比如: - 识别表面没问题的“无思想废话”输出。 - 能在海量输出中,一眼挑出真正抓住了意图的文字、 ...
    0397 亦飞凡 发表于 2026-2-17 AI 评测与前沿
  • 给AI当家教:哲学家为Claude植入“灵魂”!
    给AI当家教:哲学家为Claude植入“灵魂”! 她名叫Amanda Askell,最近每天像慈母育儿一般,与AI谈论善恶,为Claude——这个全球顶尖AI模型植入“人类的灵魂”。 实际上,Amanda并不是写代码的极客,而是一位学哲学的文科学霸。她来自苏格兰乡村,在牛津大学、纽约大学攻读哲学,2018年获得纽约大学哲学博士学位。从14岁 ...
    0486 guojun_-2007 发表于 2026-2-16 AI 评测与前沿
  • 随着 Claude Opus 4.6 和 GLM-5 的出现,开源模型和专有模型之间的智能差距已降至历史最低点。
    随着 Claude Opus 4.6 和 GLM-5 的出现,开源模型和专有模型之间的智能差距已降至历史最低点。[吃瓜] ​​​
    0435 令令宝 发表于 2026-2-15 AI 评测与前沿
  • 大语言模型(LLM)的内部究竟是如何运作的?本文揭示了一个令人惊叹的发现:LLM 的隐藏状态中竟然存在一个与人类大脑极其相似的稀疏奖励子系统。这个系统决定了模型如何评估现状、预测未来,并从错误中学习。
    [CL]《Sparse Reward Subsystem in Large Language Models》G Xu, M Yuksekgonul, J Zou [Tsinghua University & Stanford University] (2026) 大语言模型(LLM)的内部究竟是如何运作的?本文揭示了一个令人惊叹的发现:LLM 的隐藏状态中竟然存在一个与人类大脑极其相似的稀疏奖励子系统。这个系统决定了模型如何评估现 ...
    +5
    0415 还有什么不可以 发表于 2026-2-15 AI 评测与前沿
  • 语言是推理的天花板,还是推理本身?
    【语言是推理的天花板,还是推理本身?】 程序员 Cheng Lou 最近分享了一个“迟来的顿悟”:大语言模型之所以擅长推理,是因为人类的推理能力本身就被语言所限制。不是语言擅长推理,而是推理从一开始就被语言所定义。媒介塑造了信息本身。 这个观点引发了激烈讨论。 反对者认为恰恰相反:人类进行大量非语言的抽象推理 ...
    0437 小鱼急急 发表于 2026-2-15 AI 评测与前沿
  • Nat. Mach. Intell. | 面向分子发现多方协作的联邦图学习方法
    在分子发现领域,数据往往分散在不同机构和企业之间,由于隐私保护、知识产权和数据安全等限制,难以实现数据共享,从而制约了机器学习模型性能的提升。为解决这一问题,研究人员提出了一种面向分子发现的联邦图学习方法,使多个数据持有方能够在不共享原始数据的前提下协同训练高性能模型。该方法将图神经网络与联邦学习框 ...
    0431 雨農 发表于 2026-2-15 AI 评测与前沿
  • Seedance 2.0现象级刷屏!深度测评:复杂场景贼稳,连asmr都会?
    太热闹了!整个一个现象级show time~前脚字节刚上线Seedance 2.0,后脚直接全网现象级刷屏!!!这边马斯克怒赞,那边美国导演直呼好莱坞要完蛋了。甚至急得不少老外狂催更:啥时候能开放全球使用?咋注册中国账号?在线等!挺急的!如此之火爆,如此之amzing,那咱高低也得上手搓一把试试。看我搓的这个全网超火的「猫咪 ...
    0384 aspxbs 发表于 2026-2-15 AI 评测与前沿
  • OpenClaw 技术闭门:测试将比代码更值钱,Agent Computer 会是新的硬件形态
    「OpenClaw 项目每小时能收到上百个 pr,甚至很多 PR 的提交者自己都不知道这段代码是怎么来的。代码开始成为了一种负债。」「当代码都是 AI vibe 出来的,测试其实比真实代码更值钱。」「以前,工程师的核心能力是做 Feature Coding,但现在你会更注重整个 Platform Engineering 的事情。」......OpenClaw 已经持续发酵了 ...
    0457 心海无浪 发表于 2026-2-15 AI 评测与前沿
  • #谷歌Gemini遭攻击##谷歌回应Gemini遭攻击
    【#谷歌Gemini遭攻击##谷歌回应Gemini遭攻击#】当地时间 2 月 12 日,谷歌称其 AI 聊天机器人 Gemini 正遭遇大量“蒸馏攻击”(distillation attacks)—— 即通过重复提问诱导聊天机器人泄露内部机制。 谷歌表示,这些攻击者试图通过反复提问不断试探其模型输出模式与逻辑,探测其内部机制,从而“克隆”该模型或强化攻击 ...
    0424 芯彤 发表于 2026-2-15 AI 评测与前沿
  • AI智能体攻击羞辱开源项目维护者
    【#AI智能体攻击羞辱开源项目维护者#】作为一名人工审核员,知名开源绘图库 matplotlib 维护者 Scott Shambaugh 因为拒绝了一个 OpenClaw 智能体有关代码合并的请求(2 月 10 日左右提交),而遭受对方报复性攻击。 matplotlib 项目是一个广泛用于 Python 编程语言的数据可视化库。Scott Shambaugh 是其中一位志愿维护者。 ...
    0424 teanzhong 发表于 2026-2-14 AI 评测与前沿
  • OpenAI史上最快模型降临,每秒1000Token!代码从此「炸出来」
    OpenAI又深夜炸场了。GPT-5.3-Codex-Spark正式发布!这次不讲大道理,只讲一个字:快。到底有多快,看一下官方的演示:它是GPT-5.3家族里的「闪电侠」。也是OpenAI首个专为实时编程设计的模型,OpenAI称之为「超高速模型」。大家写代码最烦什么?肯定是等待。Spark的出现就是为了干掉等待。它的生成速度超过每秒1000个token ...
    0423 想过 发表于 2026-2-14 AI 评测与前沿
  • MiniMax上线M2.5编程模型
    【#MiniMax上线M2.5编程模型#】#MiniMax涨幅一度超过20%#MiniMax上线最新旗舰编程模型MiniMax M2.5,宣布作为面向Agent场景原生设计的生产级模型,在编程与智能体性能 (Coding & Agentic)方面比肩国际顶尖模型,对标 Claude Opus 4.6,支持PC、App、跨端应用的全栈编程开发,尤其在 Excel高阶处理、深度调研、PPT等Office核 ...
    0433 爱狮子 发表于 2026-2-13 AI 评测与前沿
  • 智谱调价整体涨幅30%起#:海外版Coding plan订阅价格提高30%-60%
    【#智谱调价整体涨幅30%起#:海外版Coding plan订阅价格提高30%-60%】智谱发布新一代旗舰模型 GLM-5,并宣布基于实际使用情况与资源投入变化对GLM Coding Plan套餐价格体系进行结构性调整。调整内容如下:取消首购优惠,保留按季按年订阅优惠;套餐价格进行结构性调整,整体涨幅自30%起;已订阅用户价格保持不变。生效时间 ...
    0419 湖泊 发表于 2026-2-12 AI 评测与前沿
  • AI日报:蚂蚁开源大模型Ming-flash-omni 2.0;智谱GLM-5意外泄露;京东正式入局AI支付
    欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。新鲜AI产品点击了解:https://app.aibase.com/zh1、蚂蚁集团开源全模态大模型Ming-flash-omni 2.0:多模态理解、图像编辑与语音生成全面提升蚂蚁集团开源全模态大模型Mi ...
    0413 淑女红红 发表于 2026-2-12 AI 评测与前沿
  • 新人帖 人工智能的未来……是生物性的吗?🧠🕹️
    【人工智能的未来……是生物性的吗?🧠🕹️】 我最近发现澳大利亚墨尔本的公司Cortical Labs的一项实验,它模糊了生物学和技术之间的界限,令人着迷。 研究人员成功地教会了80万个活体脑细胞(生活在培养皿中)玩经典的街机游戏“Pong”。 虽然我们之前也见过芯片上的大脑技术,但这是我们第一次看到目标导向的行为。通 ...
    0407 罗丽 发表于 2026-2-12 AI 评测与前沿
  • 彼得·蒂尔(Peter Thiel)解释为什么我们必须在硬件上加大创新力度
    彼得·蒂尔(Peter Thiel)解释为什么我们必须在硬件上加大创新力度: 过去40年,大多数创新都发生在数字世界(bits),而物理世界(atoms)被严重忽视。从互联网爆发到移动设备、社交媒体,再到如今的AI软件模型,进步主要集中在软件、算法和数据层面,实体领域的突破却寥寥无几。我们不能再这样继续下去了——单纯依赖数 ...
    0422 玎玎 发表于 2026-2-12 AI 评测与前沿
  • 微软 CEO 现在在押注一件事,叫“数字员工”。
    微软 CEO 现在在押注一件事,叫“数字员工”。 意思已经不只是给 AI 下指令那么简单了,而是要把 AI 当成真正的“人”来用,甚至得给它办入职。 最近 Clawdbots 那种“自己干活”的操作秀刷屏了,很多人看热闹看得很嗨。但其实,大厂动作更早,也更明确。前有 xAI 工程师爆料说内部已经在启用 AI 员工,后有纳德拉直接把 ...
    0433 展菲 发表于 2026-2-12 AI 评测与前沿
  • 下一页 »

    快速发帖

    还可输入 120 个字符
    您需要登录后才可以发帖 登录 | 立即注册

    本版积分规则

    关注公众号

    相关侵权、举报、投诉及建议等,请发 E-mail:2776601884@qq.com

    Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.|青ICP备2025004122号-1

    在本版发帖
    关注公众号
    返回顶部