在形式化数学推理领域,反例生成长期处于被忽视的角落。
[AI]《Learning to Disprove: Formal Counterexample Generation with Large Language Models》Z Li, Z Li, K Yang, X Ma… [ETH Zurich & University of Toronto & MiroMind] (2026)
在形式化数学推理领域,反例生成长期处于被忽视的角落。现有AI系统几乎专注于定理证明,而反例——那个能在一秒内摧毁一个普遍猜想的具 ...
中国大模型版图全扫描:谁是真正的玩家?
【中国大模型版图全扫描:谁是真正的玩家?】
快速阅读: 中国LLM圈已形成“大厂+六小虎+DeepSeek”的三层格局。字节跳动Doubao领跑国内市场,DeepSeek以量化交易副业身份创造了大量技术创新,六小虎靠开放权重+廉价推理维持存在感,但长期生存能力存疑。
---
字节跳动旗下的Doubao是中国市场当之无愧的第一,Seedance ...
推荐一个短视频自动化的开源工具,叫 MoneyPrinterTurbo,GitHub 上已经 51K+ star 了。
推荐一个短视频自动化的开源工具,叫 MoneyPrinterTurbo,GitHub 上已经 51K+ star 了。
它的核心能力就一句话:输入一个关键词,自动帮你生成一条完整的短视频。文案撰写、素材匹配、字幕生成、配音合成,整个流程全自动完成。模型方面支持 DeepSeek、Qwen、Gemini 等十几种,竖屏横屏都能出,批量生成也没问题。
如果 ...
awesome-claude-code,这个项目收集了一大堆claude code相关的东西。
awesome-claude-code,这个项目收集了一大堆claude code相关的东西。
什么skills,工作流程,命令等等。
东西实在太多了,可以把它作为一个找claude code资源的一个索引。
遇到问题的时候,就上去找一找,看有没有现成的东西。
项目地址:github.com/hesreallyhim/awesome-claude-code
...
有朋友问我,为啥在网页使用 AI 大模型,跟自己调用 API 时感觉不一样,差别很大呢?
有朋友问我,为啥在网页使用 AI 大模型,跟自己调用 API 时感觉不一样,差别很大呢?
因为网页里的 AI 大模型,除了各项参数外,都内置了默认的系统提示词 system-prompt,细节可以参考下面几个开源项目。
1、system-prompts-and-models-of-ai-tools,132k Star,近 30 个 AI 大模型,AI 编程工具的系统提示词。传送门:g ...
在线构建智能体记忆库的必备利器!🚀
在线构建智能体记忆库的必备利器!🚀
Honcho 是一款开源的记忆库与托管服务,专为构建有状态的智能体(stateful agents)设计。它支持任何模型和架构,能持续学习并维护用户、智能体、群组、观点等实体的动态状态,让你的智能助手记忆力爆棚,更加可信和个性化。
主要亮点:
- 统一的“伙伴”模型,支持多参与者多会话交 ...
#开学季# 推荐一个开源项目 FlyCut Caption,一个可以在浏览器里完成字幕生成和剪辑的工具。
#开学季# 推荐一个开源项目 FlyCut Caption,一个可以在浏览器里完成字幕生成和剪辑的工具。
支持多语言自动生成带时间戳的字幕,然后直接在可视化界面中编辑、删除片段并实时预览效果。
还支持自定义字幕样式(字体、颜色、位置等)
GitHub:github.com/x007xyz/flycut-caption
##
...
让AI帮我总结这篇论文
让AI帮我总结这篇论文:http://t.cn/AXfATCbq
———
这篇发表于《Theory and Society》的论文运用大语言模型(LLM),对1960年至2024年间约60万篇英文社会科学摘要进行了意识形态分析,得出了五个关键发现。其核心结论是,社会科学研究在意识形态上长期且日益倾向于左翼。
以下是该论文的详细总结:
研究核心发现
...
Sebastian Raschka的新长篇文章:A Visual Guide to Attention Variants in Modern LLMs 现代大型语言模型注意力变体视觉指南
Sebastian Raschka的新长篇文章:A Visual Guide to Attention Variants in Modern LLMs 现代大型语言模型注意力变体视觉指南
地址:magazine.sebastianraschka.com/p/visual-attention-variants
这篇文章整理了现代大语言模型中为了提高推理效率和内存占用而演进出的各种注意力机制变体。
“在本文中,我认为回顾近年来 ...
面向末日断网场景的离线文明知识库与AI系统 如果全球互联网瞬间中断,你的电脑还能做什么?
面向末日断网场景的离线文明知识库与AI系统
如果全球互联网瞬间中断,你的电脑还能做什么?
查不了资料、用不了 AI、看不了课程、连地图都打不开,我们早已习惯依赖网络的电子设备,瞬间就会沦为一块砖头。
而现在,有个刚出圈的开源项目,直接解决了这个终极痛点。它就是Project N.O.M.A.D., 一个完全离线优先、自给自 ...
大家都在追求更大的LLM... 但GPU显存正在角落里默默流泪。😭
大家都在追求更大的LLM...
但GPU显存正在角落里默默流泪。😭
近年来,大型语言模型(LLMs)变得无比巨大 🦾,拥有数十亿(甚至数万亿)参数。它们功能强大到难以置信……但同时也极度贪婪地消耗着显存。
而这正是问题变得棘手的地方。
→ LLMs(如 GPT-4, LLaMA, Claude)需要 数十GB的GPU显存 (VRAM ...
LTX-2.3开源: 视频生成引擎级升级
Lightricks的开源续作 LTX-2.3正式开源,这是 LTX-2 音视频基础模型的重大版本更新,在视频质量以及提示词遵循方面均有提升。LTX-2.3重建了 VAE 架构、扩容文本连接器,同时改进 I2V 训练,也更换音频声码器,并首次支持原生竖版视频生成。📎ltx2-3-hero-fin-opt1.mp4
开源地址:模型权重:https://modelscope.cn/models/Lig ...
deepseek是什么?deepseek究竟是什么?
DeepSeek是一种基于深度学习和数据挖掘技术的智能搜索与分析系统,它通过深度学习模型理解数据的上下文语义,实现更智能化的搜索与分析。DeepSeek的核心技术、应用领域、功能特点及其面临的挑战,展望其在未来智能化转型中的重要作用。在大数据时代,如何从海量数据中提取有价值的信息,成为各行各业面临的共同挑战。DeepSe ...
其实一些大的企业,有自己能力的,都会构建自己的编码智能体,而不会用claude code这样的工具。 这里面有隐私、安全之类的考量。
其实一些大的企业,有自己能力的,都会构建自己的编码智能体,而不会用claude code这样的工具。
这里面有隐私、安全之类的考量。
langchain-ai,也是一个老牌的做智能体框架的公司了。
但是他们的框架一般都比较笨重。
这次,他们开源了一个用于打造企业内部编码智能体的框架:Open SWE。
这是他们自己的说明:
像Strip ...
全球生成式AI应用排名出炉 韩国A.与Papago跻身前50位[围观]
【全球生成式AI应用排名出炉 韩国A.与Papago跻身前50位[围观]】在全球生成式人工智能(AI)服务竞争日趋激烈的背景下,韩国本土AI服务“A.”和“Papago”跻身全球AI网页及移动端用户排名前50位。
整体AI市场中,ChatGPT继续以压倒性优势保持领先地位,谷歌的Gemini正凭借付费用户的快速增长形成追赶态势。
据美国风投公司 ...
小米交作业了! 一口气放出两个新模型!
小米交作业了! 一口气放出两个新模型!
前几天放出的匿名模型 Hunter Alpha, 和 Healer Alpha 终于官宣了! Hunter Alpha 是小米 MiMo-V2-Pro, 1M上下文, 1T 参数量 42B 激活参数, 支持多模态输入, 输出文本.
Healer Alpha 是小米 MiMo-V2-Omni, 262K上下文, 支持文本, 音频, 图片, 视频输入.
从架构上看, MiMo-V2-Pro 沿 ...
Kimi K2.5被同行点赞
Kimi K2.5被同行点赞
Cursor 联合创始人 Aman Sanger:我们基于困惑度评测测试了很多底座模型,Kimi K2.5 被证明是最强的;在此之后,我们又进行了持续预训练和高算力强化学习训练(规模扩大了 4 倍);强大的底座、持续预训练、强化学习,以及 Fireworks 的推理和强化学习采样器结合在一起,让 Composer-2 达到了前沿水平 ...
[CL]《Attention Residuals》G Chen, Y Zhang, J Su, W Xu… [Kimi Team] (2026)
[CL]《Attention Residuals》G Chen, Y Zhang, J Su, W Xu… [Kimi Team] (2026)
大型语言模型中,残差连接以固定权重均匀叠加所有层的输出,导致隐藏状态幅值随深度线性膨胀。深层网络被迫输出越来越大的值才能保持影响力,早期层的信息被淹没且无法被选择性召回——这是PreNorm架构的结构性缺陷,而非训练技巧可以修补 ...
我以前介绍过Kitten TTS,只有25M的语音模型,可以用CPU推理,甚至手机也能跑。
我以前介绍过Kitten TTS,只有25M的语音模型,可以用CPU推理,甚至手机也能跑。
上个月,他们发布了Kitten TTS v0.8,也才80M,依然可以在普通电脑上跑,甚至手机上跑,超级轻量级。
只是,还是不支持中文,这是一个遗憾,希望他们能尽快补齐。
特点:
超轻量级——型号大小从25 MB(int8)到80 MB,适合边缘部署
CPU优 ...
🔥盘点过去两周 GitHub 上增长最快的 AI 开源项目:
🔥盘点过去两周 GitHub 上增长最快的 AI 开源项目:
1. obra/superpowers(新增星标数:约 19.9K+,总星已破 8-10万+)
目前最成熟的智能体技能框架 + 软件工程方法论结合体。提供即插即用的 agentic skills pack,像“AI 应用商店”一样扩展代理能力。vibe coding 和实际开发玩家强烈推荐,已成为许多 agent 栈的核心 ...