订阅

开源项目与模型 今日: 0|主题: 487|排名: 3 

  • 一个开源的CUDA 内核的内核内分析器
    一个开源的CUDA 内核的内核内分析器:IKP github.com/yao-jz/intra-kernel-profiler 大多数 GPU 分析器(如 Nsight、NV Perf SDK)只会给出每次内核启动的单一数值:例如该内核执行了 1.2 万亿条指令,达到了 85% 的占用率。IKP 更深入。你可以在内核中用命名区域(如 load_A、compute、store)进行标记,每个指标——指 ...
    0360 小和哥 发表于 2026-3-27 开源项目与模型
  • 林俊旸从阿里离职后首发长文:复盘千问路线受阻,断言 AI 演进全面转向智能体
    【林俊旸从阿里离职后首发长文:复盘千问路线受阻,断言 AI 演进全面转向智能体】前阿里千问负责人林俊旸在离职长文中指出,AI 大模型正从‘推理型思考’转向‘智能体思考’。他复盘了千问团队在融合指令与思考模式时遇到的困境,并揭示了未来竞争将围绕环境设计、防作弊协议等系统工程能力展开。#…… ​​​ ...
    0306 水坤 发表于 2026-3-27 开源项目与模型
  • 在格式指令与实质任务并行时,大语言模型频繁丢失格式要求——这是一个在真实部署中普遍存在却缺乏系统研究的失效模式。
    [CL]《Did You Forget What I Asked? Prospective Memory Failures in Large Language Models》A Mittal [Microsoft] (2026) 在格式指令与实质任务并行时,大语言模型频繁丢失格式要求——这是一个在真实部署中普遍存在却缺乏系统研究的失效模式。现有评测(如IFEval)孤立地测试格式遵从,无法捕捉到"认知负载"如何侵蚀 ...
    +1
    0303 空中月 发表于 2026-3-27 开源项目与模型
  • 7天狂飙2.3万Star:在GitHub上“开外包公司”,这个新项目戳破大模型的全能幻觉
    在 GitHub 的开源世界里,很少有纯粹的“提示词工程”项目能跑出基础设施级别的增速。截至 2026 年 3 月 24 日,由开发者 Marek Sitarzewski 发起的项目 agency-agents,星标(Star)总数已突破 6万枚。在过去七天内,它净增了超过 2.3 万个星标,直接挤掉了一众砸下重金做宣发的大厂开源项目,登顶全球 GitHub 周增长榜首 ...
    0327 寂静的雾雨 发表于 2026-3-26 开源项目与模型
  • 推荐一个github项目,一个好用的在线听歌网站
    推荐一个github项目,一个好用的在线听歌网站 支持网易云、QQ、酷狗、汽水音乐等10多个主流平台,在线听和下载,无广告 地址:music.kukuqaq.com/music/ Github地址:github.com/guohuiyuan/go-music-dl ## ​​​
    0327 guojun_-2007 发表于 2026-3-26 开源项目与模型
  • 在线搭建AI开发工作站,配置环境和调试工具往往令人头疼,安装Claude Code、配浏览器无头运行、搞各种命令行AI,过程繁琐又容易出错。
    在线搭建AI开发工作站,配置环境和调试工具往往令人头疼,安装Claude Code、配浏览器无头运行、搞各种命令行AI,过程繁琐又容易出错。 HolyClaude 这个开源容器项目,整合了 Claude Code 主力代码AI、直观Web界面、五大AI命令行工具、无头浏览器和50+开发工具,统一容器化部署,轻轻松松跑起来。 只需一条docker-compose ...
    0347 xiaoling 发表于 2026-3-26 开源项目与模型
  • 这仓库有点意思,让🦞自己给自己挣电费🥹。本质上是在给 OpenClaw 安一个“职业赏金猎人”人活就格:不是见冲,而是先算这单值不值。比“全自动接单致富”那类口号务实多了。
    这仓库有点意思,让🦞自己给自己挣电费🥹。本质上是在给 OpenClaw 安一个“职业赏金猎人”人格:不是见活就冲,而是先算这单值不值。比“全自动接单致富”那类口号务实多了。 🦞锐评:真正成熟的 agent,不是更会干活,而是更会拒绝不划算的活。会止损,比会冲锋更稀缺。 📎 Atlas: The OpenClaw Bounty Hunter Skill 🔗 ...
    0335 石之心 发表于 2026-3-26 开源项目与模型
  • 谷歌新型缓存技术将压缩6倍闪存需求
    【#谷歌新型缓存技术将压缩6倍闪存需求#】近期,谷歌发布了名为TurboQuant的 KV 缓存压缩技术,旨在解决大语言模型(LLM)推理过程中显存占用过高的问题。该技术核心在于无需重新训练或微调模型,即可将键值缓存(KV Cache)压缩至3-bit精度,实现约6倍的闪存节省,同时在英伟达 H100 等加速器上可将推理速度提升最高8倍。 ...
    0310 爱深求 发表于 2026-3-26 开源项目与模型
  • 谷歌这个论文非常厉害,大模型推理内存革命了,节省资源非常厉害
    谷歌这个论文非常厉害,大模型推理内存革命了,节省资源非常厉害 怪不得昨晚美股存储跌了,有点类似DeepSeek的冲击。算法加速,让硬件资源效率大幅提升。这个TurboQuant算法感觉会流行起来。 我一开始以为是,对内存中的大模型“KV缓存”(80%内存都是这个东西占了)搞个什么6倍的压缩算法,这样内存就可以少用了。但是要 ...
    0324 FineRIk 发表于 2026-3-26 开源项目与模型
  • 🚀GitHub Copilot 新政:4月24日起默认用你的交互数据训练AI模型
    🚀GitHub Copilot 新政:4月24日起默认用你的交互数据训练AI模型 GitHub 今日宣布,从 2026年4月24日 开始,将默认使用 Copilot Free、Pro 和 Pro+ 用户的交互数据训练 AI 模型。 具体数据包括:输入提示、输出建议、代码片段以及关联上下文(仓库结构、聊天记录等)。此举旨在让 Copilot 提供更准确、更安全、更有上下文 ...
    0301 兔子吃窝边肉 发表于 2026-3-26 开源项目与模型
  • 今日推介(第2086期):高效通用感知编码器、针对“自动化研究”本身的元研究、基于条件流匹配的统一神经算子学习
    今日推介(第2086期):高效通用感知编码器、针对“自动化研究”本身的元研究、基于条件流匹配的统一神经算子学习、通过特征稀疏性实现注意力机制的规模化、更稀疏更高效更轻量化的 Transformer 语言模型 公·众·号:爱可可爱生活 http://t.cn/AXfgADLS #​​​ ...
    0336 想过 发表于 2026-3-26 开源项目与模型
  • 一句“嘿”吞掉22%用量配额,Claude的计费逻辑你可能从没搞清楚
    【一句“嘿”吞掉22%用量配额,Claude的计费逻辑你可能从没搞清楚】 快速阅读: 有用户发现对一个久置的Claude Code会话发了句“hey”,用量暴涨22%。这不是bug,而是LLM的底层工作机制——每条新消息都会把整个对话历史重新发送一遍。叠加缓存过期、1M超长上下文等因素,账单会失控得很优雅。 --- 每次你在一个旧会话 ...
    0354 闻听 发表于 2026-3-26 开源项目与模型
  • 在多模型推理调度领域,「如何在不实际生成回复的情况下,预判哪个模型最适合处理当前请求」是一个悬而未决的难题。
    [CL]《Expected Reward Prediction, with Applications to Model Routing》K Hasanaliyev, S Alberti, J Hamer, D Rajagopal… [Stanford University & Google DeepMind] (2026) 在多模型推理调度领域,「如何在不实际生成回复的情况下,预判哪个模型最适合处理当前请求」是一个悬而未决的难题。过去的路由方法需要收集 ...
    +1
    0364 吴歌 发表于 2026-3-26 开源项目与模型
  • 在自动化科研(autoresearch)领域,LLM 驱动的超参数搜索已初见成效,但所有现有系统的搜索机制本身
    [AI]《Bilevel Autoresearch: Meta-Autoresearching Itself》Y Qu, M Lu (2026) 在自动化科研(autoresearch)领域,LLM 驱动的超参数搜索已初见成效,但所有现有系统的搜索机制本身——何时接受、如何提案、维护什么状态——都由人类工程师在系统设计时固化写死。LLM 只是搜索的执行者,而非搜索机制的设计者。每一次系 ...
    0362 铉霸 发表于 2026-3-26 开源项目与模型
  • 探索这款开源的 AI 多智能体框架,它是 Agency Swarm 的轻量化替代方案。
    探索这款开源的 AI 多智能体框架,它是 Agency Swarm 的轻量化替代方案。该项目基于先进的任务编排理念,允许开发者构建可协作的 AI Agent 系统来处理复杂业务逻辑。通过灵活的角色定义与工具集成,你可以快速搭建自动化工作流,实现多代理协同作业,是提升企业自动化水平与 AI 开发效率的实战利器。 #http://t.cn/AXfYq1 ...
    0387 春运 发表于 2026-3-25 开源项目与模型
  • 🚀Anthropic 推出《Anthropic Science Blog》:AI 加速科学研究的桥梁
    🚀Anthropic 推出《Anthropic Science Blog》:AI 加速科学研究的桥梁 2026 年 3 月 23 日,Anthropic 在官方 X 账号宣布推出 Anthropic Science Blog,旨在加速科学进步——这正是公司使命的核心部分。该博客将发布最新研究成果,以及科学家如何借助 AI 推动工作的真实故事。 一、首发内容亮点: 1️⃣- 《Can AI do th ...
    0344 梅琴 发表于 2026-3-25 开源项目与模型
  • 神经网络持久结构化记忆中的坐标系问题
    我们提出了双视图信息素路径网络(DPPN),这是一种通过潜在槽位(latent slot)转换上的**持久信息素场(persistent pheromone field)**来路由稀疏注意力的架构。利用该架构,我们发现了神经网络实现持久结构化记忆的两个独立必要条件。 通过 5 组逐步完善的实验(涵盖 5 种模型变体、4 个迁移目标,且每种条件下使用多达 ...
    0330 西域·骆驼 发表于 2026-3-25 开源项目与模型
  • 推荐一个开源项目 Voice-Pro,一款可以本地部署的 AI 配音 + 视频翻译 + 语音克隆工具。
    推荐一个开源项目 Voice-Pro,一款可以本地部署的 AI 配音 + 视频翻译 + 语音克隆工具。 把语音识别、翻译、字幕生成、配音和语音克隆全部整合在一起。 整个流程可以在本地运行,不依赖在线平台,支持多语言语音识别与翻译,对视频创作者来说非常实用。 地址:github.com/abus-aikorea/voice-pro ## ...
    0348 天生艺术家 发表于 2026-3-25 开源项目与模型
  • 版本避坑提醒
    【版本避坑提醒】 Claude Code 新版本有个坑:缓存命中有问题,会导致消耗莫名变大。别问我怎么知道的,反正钱包会告诉你答案。 降级方案: Claude Code(命令行)→ 用 2.1.77 以下 插件 → 用 2.1.76 以下 Step 1:卸载当前版本 npm uninstall -g @anthropic-ai/claude-code Step 2:安装指定版本 npm install -g @ ...
    0424 王荣超 发表于 2026-3-25 开源项目与模型
  • MiniMax 开源了一个针对 AI 编程工具(Claude、Cursor、Codex 等)的结构化技能库
    MiniMax 开源了一个针对 AI 编程工具(Claude、Cursor、Codex 等)的结构化技能库,生产级质量的开发指导。 1. frontend-dev:React/Next.js、Tailwind、Framer Motion、3D 生成艺术(Three.js、p5.js)、还能调 MiniMax API 生成媒体 2. fullstack-dev:REST API 设计、认证、实时功能、数据库集成等 3. 移动端:Android ...
    0330 sinalook 发表于 2026-3-25 开源项目与模型
  • 下一页 »

    快速发帖

    还可输入 120 个字符
    您需要登录后才可以发帖 登录 | 立即注册

    本版积分规则

    关注公众号

    相关侵权、举报、投诉及建议等,请发 E-mail:2776601884@qq.com

    Powered by Discuz! X5.0 © 2001-2026 Discuz! Team.|青ICP备2025004122号-1

    在本版发帖
    关注公众号
    返回顶部