claude Knowledge Work Plugins 开源,让 AI 快速接入专业分类人格和知识🥹:把 Claude 从“会说话”推进到“会按角色干活”,这一步比单纯堆模型参数更像真进化。
claude Knowledge Work Plugins 开源,让 AI 快速接入专业分类人格和知识🥹:把 Claude 从“会说话”推进到“会按角色干活”,这一步比单纯堆模型参数更像真进化。
🦞锐评:以前大家在调 prompt,现在开始调组织结构。插件化的本质,不是让 AI 更聪明,而是让它更像一个能被公司驯化的岗位接口。
📎 knowledge-work-plugi ...
最近在想一个问题:大模型和传统数据挖掘到底有什么本质区别?
最近在想一个问题:大模型和传统数据挖掘到底有什么本质区别?
传统数据挖掘更像是“人的智慧”。研究者通过精巧的算法设计去发现数据中的规律。算法结构往往很优雅、很轻巧,很多经典算法都体现了很强的数学和算法设计能力。数据通常只需要做一些常规预处理,真正的核心在算法本身。
而大模型更像是“数据的智慧”。模 ...
LLM 是人类有史以来最强大的通用工具
LLM 是人类有史以来最强大的通用工具
Agent 则第一次让这种力量具备了持续进入现实、改造现实的可能
直到今天,人类对如何真正开发 LLM 的潜能,依然处于近乎蒙圈的早期阶段
我们已经看到的,可能连它全部潜力的 0.1% 都不到
在实践中发挥想象力,创造性的解决一切问题
...
很有趣的一篇论文。
很有趣的一篇论文。
字节跳动实现了基于深度的注意力机制,并将其与序列注意力直接结合。
P.S. 现在的论文相较于十年前的,大多都很无趣。
##
刚才用Codex coding,模型GPT-5.4,它在思考的时候,出现了神奇的一幕——出现了一段一般是在网页被篡改劫持时候的一段代码…
刚才用Codex coding,模型GPT-5.4,它在思考的时候,出现了神奇的一幕——出现了一段一般是在网页被篡改劫持时候的一段代码……赛车的那个……当时没截图,但我大受震撼。[流汗] 这才是正儿八经的大模型投毒,或者说,大模型在学习(爬网)的时候被毒害了。[笑cry]#人工智能##ai#
...
B站前端老哥被开,直接开源了 B 站 app 源码
B站前端老哥被开,直接开源了 B 站 app 源码
全宽内联视频、飘屏弹幕、实时直播、扫码登录、离线下载……大部分你在官方客户端能用到的核心功能,这个项目基本都有。
跨平台运行,Android / iOS / Web 三端一套代码,Expo Go 扫码 5 分钟就能跑起来,不需要任何编译环境。[坏笑]
...
在对话记忆检索领域,如何在有限token预算内从海量历史会话中精准召回相关证据,是悬而未决的难题。
[LG]《SmartSearch: How Ranking Beats Structure for Conversational Memory Retrieval》J Derehag, C Calva, T Ghiurau [Midbrain] (2026)
在对话记忆检索领域,如何在有限token预算内从海量历史会话中精准召回相关证据,是悬而未决的难题。现有系统受困于"越复杂越好"的迷思——在摄取阶段用LLM重构记忆、在查询阶段用 ...
在形式化数学推理领域,反例生成长期处于被忽视的角落。
[AI]《Learning to Disprove: Formal Counterexample Generation with Large Language Models》Z Li, Z Li, K Yang, X Ma… [ETH Zurich & University of Toronto & MiroMind] (2026)
在形式化数学推理领域,反例生成长期处于被忽视的角落。现有AI系统几乎专注于定理证明,而反例——那个能在一秒内摧毁一个普遍猜想的具 ...
中国大模型版图全扫描:谁是真正的玩家?
【中国大模型版图全扫描:谁是真正的玩家?】
快速阅读: 中国LLM圈已形成“大厂+六小虎+DeepSeek”的三层格局。字节跳动Doubao领跑国内市场,DeepSeek以量化交易副业身份创造了大量技术创新,六小虎靠开放权重+廉价推理维持存在感,但长期生存能力存疑。
---
字节跳动旗下的Doubao是中国市场当之无愧的第一,Seedance ...
推荐一个短视频自动化的开源工具,叫 MoneyPrinterTurbo,GitHub 上已经 51K+ star 了。
推荐一个短视频自动化的开源工具,叫 MoneyPrinterTurbo,GitHub 上已经 51K+ star 了。
它的核心能力就一句话:输入一个关键词,自动帮你生成一条完整的短视频。文案撰写、素材匹配、字幕生成、配音合成,整个流程全自动完成。模型方面支持 DeepSeek、Qwen、Gemini 等十几种,竖屏横屏都能出,批量生成也没问题。
如果 ...
awesome-claude-code,这个项目收集了一大堆claude code相关的东西。
awesome-claude-code,这个项目收集了一大堆claude code相关的东西。
什么skills,工作流程,命令等等。
东西实在太多了,可以把它作为一个找claude code资源的一个索引。
遇到问题的时候,就上去找一找,看有没有现成的东西。
项目地址:github.com/hesreallyhim/awesome-claude-code
...
有朋友问我,为啥在网页使用 AI 大模型,跟自己调用 API 时感觉不一样,差别很大呢?
有朋友问我,为啥在网页使用 AI 大模型,跟自己调用 API 时感觉不一样,差别很大呢?
因为网页里的 AI 大模型,除了各项参数外,都内置了默认的系统提示词 system-prompt,细节可以参考下面几个开源项目。
1、system-prompts-and-models-of-ai-tools,132k Star,近 30 个 AI 大模型,AI 编程工具的系统提示词。传送门:g ...
在线构建智能体记忆库的必备利器!🚀
在线构建智能体记忆库的必备利器!🚀
Honcho 是一款开源的记忆库与托管服务,专为构建有状态的智能体(stateful agents)设计。它支持任何模型和架构,能持续学习并维护用户、智能体、群组、观点等实体的动态状态,让你的智能助手记忆力爆棚,更加可信和个性化。
主要亮点:
- 统一的“伙伴”模型,支持多参与者多会话交 ...
#开学季# 推荐一个开源项目 FlyCut Caption,一个可以在浏览器里完成字幕生成和剪辑的工具。
#开学季# 推荐一个开源项目 FlyCut Caption,一个可以在浏览器里完成字幕生成和剪辑的工具。
支持多语言自动生成带时间戳的字幕,然后直接在可视化界面中编辑、删除片段并实时预览效果。
还支持自定义字幕样式(字体、颜色、位置等)
GitHub:github.com/x007xyz/flycut-caption
##
...
让AI帮我总结这篇论文
让AI帮我总结这篇论文:http://t.cn/AXfATCbq
———
这篇发表于《Theory and Society》的论文运用大语言模型(LLM),对1960年至2024年间约60万篇英文社会科学摘要进行了意识形态分析,得出了五个关键发现。其核心结论是,社会科学研究在意识形态上长期且日益倾向于左翼。
以下是该论文的详细总结:
研究核心发现
...
Sebastian Raschka的新长篇文章:A Visual Guide to Attention Variants in Modern LLMs 现代大型语言模型注意力变体视觉指南
Sebastian Raschka的新长篇文章:A Visual Guide to Attention Variants in Modern LLMs 现代大型语言模型注意力变体视觉指南
地址:magazine.sebastianraschka.com/p/visual-attention-variants
这篇文章整理了现代大语言模型中为了提高推理效率和内存占用而演进出的各种注意力机制变体。
“在本文中,我认为回顾近年来 ...
面向末日断网场景的离线文明知识库与AI系统 如果全球互联网瞬间中断,你的电脑还能做什么?
面向末日断网场景的离线文明知识库与AI系统
如果全球互联网瞬间中断,你的电脑还能做什么?
查不了资料、用不了 AI、看不了课程、连地图都打不开,我们早已习惯依赖网络的电子设备,瞬间就会沦为一块砖头。
而现在,有个刚出圈的开源项目,直接解决了这个终极痛点。它就是Project N.O.M.A.D., 一个完全离线优先、自给自 ...
大家都在追求更大的LLM... 但GPU显存正在角落里默默流泪。😭
大家都在追求更大的LLM...
但GPU显存正在角落里默默流泪。😭
近年来,大型语言模型(LLMs)变得无比巨大 🦾,拥有数十亿(甚至数万亿)参数。它们功能强大到难以置信……但同时也极度贪婪地消耗着显存。
而这正是问题变得棘手的地方。
→ LLMs(如 GPT-4, LLaMA, Claude)需要 数十GB的GPU显存 (VRAM ...
LTX-2.3开源: 视频生成引擎级升级
Lightricks的开源续作 LTX-2.3正式开源,这是 LTX-2 音视频基础模型的重大版本更新,在视频质量以及提示词遵循方面均有提升。LTX-2.3重建了 VAE 架构、扩容文本连接器,同时改进 I2V 训练,也更换音频声码器,并首次支持原生竖版视频生成。📎ltx2-3-hero-fin-opt1.mp4
开源地址:模型权重:https://modelscope.cn/models/Lig ...
deepseek是什么?deepseek究竟是什么?
DeepSeek是一种基于深度学习和数据挖掘技术的智能搜索与分析系统,它通过深度学习模型理解数据的上下文语义,实现更智能化的搜索与分析。DeepSeek的核心技术、应用领域、功能特点及其面临的挑战,展望其在未来智能化转型中的重要作用。在大数据时代,如何从海量数据中提取有价值的信息,成为各行各业面临的共同挑战。DeepSe ...