【本周GitHub AI 热榜】 这周最明显的信号是,AI Agent 开始从“会聊天、会写代码”,走向“能长期干活”。
【本周GitHub AI 热榜】
这周最明显的信号是,AI Agent 开始从“会聊天、会写代码”,走向“能长期干活”。
1. reverse-skill
GitHub: https://github.com/zhaoxuya520/reverse-skill
本周新增 9,784 星。
这是一个 AI 安全技能路由包,面向逆向工程和渗透测试场景。它解决的问题很具体:AI 编码助手遇到 APK、二 ...
写 SQL 写到一半,想查看表结构,却发现还得切换到另一个工具才能查找——这种突兀的切换感,你懂的吧?
写 SQL 写到一半,想查看表结构,却发现还得切换到另一个工具才能查找——这种突兀的切换感,你懂的吧?
Tabularis 能帮你轻松解决这个问题。它是一款开源的桌面 SQL 工作台,支持超过 15 种数据源,包括 PostgreSQL、MySQL、SQLite、DuckDB、ClickHouse、Redis、Firestore 等等。
它的杀手锏是内置的 MCP 服务器,让 Cla ...
AI 代理现在不仅可以操作浏览器,甚至可以控制真正的 iPhone
AI 代理现在不仅可以操作浏览器,甚至可以控制真正的 iPhone
这个开源项目名为 Phone Harness
它直接利用了 macOS 的 iPhone 镜像功能:
- 使用视觉 OCR 识别屏幕文本和坐标
- 使用系统级事件完成点击、长按、滑动和输入
- 操作后截屏以验证结果是否正确
- 无需越狱、Xcode 或 WebDriverAgent
我的看法:它不是 iPho ...
Freebuff 已经将 DeepSeek V4 Pro Flash 等模型免费提供给开发者使用,而且已经有 24 万开发者在用了😲😲😲
我的天,DeepSeek V4 Flash 居然免费?!
Freebuff 已经将 DeepSeek V4 Pro Flash 等模型免费提供给开发者使用,而且已经有 24 万开发者在用了😲😲😲
Freebuff 的模式是用户完全免费,AI Token 的费用由广告商承担。
他们刚刚宣布 DeepSeek V4 Pro 可以 100% 免费使用。其背后的 Freebuff 平台已经拥有 243,958 位开发者 ...
本周GitHub AI 热榜
【本周GitHub AI 热榜】
这周最明显的信号是,AI Agent 开始从“会聊天、会写代码”,走向“能长期干活”。
1. reverse-skill GitHub: https://github.com/zhaoxuya520/reverse-skill本周新增 9,784 星。这是一个 AI 安全技能路由包,面向逆向工程和渗透测试场景。它解决的问题很具体:AI 编码助手遇到 APK、二进制、JS ...
[AI]《Thought-Level Beam Search for Reasoning》L Yang, H Luo, T Dao, R Netravali [Princeton University & MIT & Meta AI] (2026)
[AI]《Thought-Level Beam Search for Reasoning》L Yang, H Luo, T Dao, R Netravali [Princeton University & MIT & Meta AI] (2026)
在大型模型推理领域,如何在固定算力下高效探索解题路径是一个悬而未决的难题。过去的方法受困于“并行采样”的内存溢出与“剪枝”的算力闲置,本质原因是它们无法将从失败路径释放的 ...
我只是作为一个“普通用户”的角度去用 DeepSeek Harness,一些感受
我只是作为一个“普通用户”的角度去用 DeepSeek Harness,一些感受:
1. 启动方式偏极客,程序员没问题,但是普通用户估计都没有nodejs环境,很难跑起来
2. 速度飞快,这点特别好
3. Thinking 部分由于 Flash 模型速度过快,导致文字闪的厉害,可以做一下节流,攒一批一起显示,配合动效会好一点。
4. Codex 右侧的多 ...
DeepSeek发布V4Pro正式版
#DeepSeek发布V4Pro正式版#
这次V4Pro正式版升级真的诚意满满,重点强化Agent智能体能力,原生适配Responses API和Codex,写代码、自动调用工具完成复杂任务表现远超不少开源模型。数学推导、全栈开发、长文档分析全场景无短板,极限推理模式下逻辑严谨度比肩顶级闭源大模型
...
告别Prompt玄学:为什么顶级实验室都在搞“马具”工程?
【告别Prompt玄学:为什么顶级实验室都在搞“马具”工程?】最近开源的《Learn Harness Engineering》课程引起了圈内关注,它把AI落地的重心从调教Prompt转移到了构建“Harness”(驾驭系统)上。该项目深度拆解了OpenAI与Anthropic的内部工程方案,其重点不是去拔高模型的天花板,而是通过环境设计、状态监控和闭环验证, ...
从榜单看,都是Fable级别
2022年的 AI vs 2026年的 AI
Claude 打破平台壁垒:Chrome 侧边栏 AI 对话互通全平台历史记录
【Claude 打破平台壁垒:Chrome 侧边栏 AI 对话互通全平台历史记录】Anthropic 今天(8 月 13 日)在 X 平台发布推文,宣布升级适用于谷歌 Chrome 浏览器的 Claude 扩展程序,在侧边栏带来完整的 Claude Cowork 会话体验。
一张图,跑出一条 3D 资产生产线
一张图,跑出一条 3D 资产生产线
刚刷到一个 GitHub 项目,名字叫 img2threejs,看完直接给我整懵了,太离谱了。
它干的事特别简单:你给它一张参考图,它就让 Agent 把这个物体重建成纯代码的 Three.js 模型。注意,是纯代码,没有模型文件,也没有贴图,整个物体就是一段代码,扔进浏览器就能跑。
更妙的是,它能跟 Co ...
这个人把搬运 YouTube 视频做成了完整的全自动化流程
这个人把搬运 YouTube 视频做成了完整的全自动化流程:
丢进去一个 YouTube 链接,它就可以下载视频,按需识别和翻译字幕,生成标题、简介、标签和分区,经过自动或人工审核,再投到 AcFun、bilibili。
还能监控指定频道和关键词,把发现的新视频继续送进任务队列。
跑起来之后,它就是一条不会下班的视频运营流水线。
...
刚看了一个消息,韩国的DeepSeek横空出世!
刚看了一个消息,韩国的DeepSeek横空出世!
还是韩国团队独立自主开发的AI模型,分数达到了DeepSeek级别,
这款由韩国团队Motif制作Motif-3 Beta,外部评估中听说DeepSeek V4 Pro同等分数,3140亿规模的模型,竟然也直接开源!
这点也挺让人惊讶的,难道韩国也真的要进入LLM领域了吗?
还是只是蒸馏我们的?
让子弹飞一会儿吧 ...
如果非要刻舟求剑的话,可以看看这张图🤣
如果非要刻舟求剑的话,可以看看这张图🤣
意思是说:如果把 Netscape 发布和 ChatGPT 发布这两个事件分别作为互联网周期与 AI 周期的起点,Nasdaq 在两轮科技周期早期的路径高度相似;而两轮周期中的重要杠杆事件——长期资本公司(LTCM) blowup 与 Situational Awareness forced unwind,巧合的都出现在了第 1337 天附近 ...
在小内存的mac机器上跑Gemma 4 26B-A4B模型的项目
在小内存的mac机器上跑Gemma 4 26B-A4B模型的项目
地址:github.com/drumih/turbo-fieldfare
8 GB内存的 M2 MacBook Air也能跑,速度大概5.10–6.30 token/s
24 GB M5 Pro上就可以提速到80 token/s了。
原理也还是把大部分 MoE 专家权重放在 SSD 上,用到哪个专家,就临时读取哪个专家。
...
三手消息:MiniMax H3 可以在3060 显卡上运行啊
三手消息:MiniMax H3 可以在3060 显卡上运行啊
---------------
MiniMax H3 在 ComfyUI 中的性能细节披露
以下内容来自 Banodoco Discord 服务器的 ComfyAnonymous:
"毫无疑问,在 3060 显卡上也能运行,832x480 分辨率、124 帧画面,目前使用 8 位权重在 3060 + 32GB 内存 + NVMe 固态硬盘上只需不到 10 分钟,而且 ...
硅谷现在吵翻天了,分成两派,立场完全相反。
硅谷现在吵翻天了,分成两派,立场完全相反。
OpenAI、Anthropic支持封禁,靠闭源模型赚高额服务费。
英伟达、微软带头反对,他们靠卖算力、云服务赚钱。
国产开源AI越普及,全球GPU采购量越高。
DeepSeek这种平价模型,拉低行业门槛,放大算力需求。资本永远优先考虑自身生意,而非单纯技术封锁。#DeepSeekV4Flash 便宜## ...
好图已保存,DeepSeek 截断线