DeepSeek V4 Flash 新增了 Vision Exp 多模态模型
DeepSeek V4 Flash 新增了 Vision Exp 多模态模型
刷新下 API 直接能加载出来了
核心能力
• 图像理解:描述图片、读截图文字(OCR)、分析图表等
• 支持格式:JPEG / PNG / GIF / WebP(按文件实际内容识别,不看文件名/MIME)
• 上下文 1M,最大输出 384K,与 V4 Flash 一致
• 思考模式:thinking / non-thinking ...
Anthropic 被开发者爆出 Claude Code 暗中改动推理档位悄悄降智
Anthropic 被开发者爆出 Claude Code 暗中改动推理档位悄悄降智,high 推理配置被悄悄映射成低档位参数,没有在更新日志中做任何说明。官方出面解释属于 A/B 实验,但用户反馈 Opus5 同样出现输出敷衍、频繁低级失误等降智现象,也暴露出云端大模型后台改动不透明,跑分与实际使用体感相互脱节的行业痛点。
...
OpenAI 准备降低GPT5.6 Sol的价格,那可真是太好了
OpenAI 准备降低GPT5.6 Sol的价格,那可真是太好了,不然现在Sol用多了真的消耗挺快的。
Luna 现在的性价比真是高上高。
将整个 Obsidian Vault 可视化为一个交互式圆形知识图谱,并可将其导出为单个离线 HTML 文件。
将整个 Obsidian Vault 可视化为一个交互式圆形知识图谱,并可将其导出为单个离线 HTML 文件。
https://github.com/luke321/vault-graph
Cetus:把 Claude Code、Codex、DeepSeek Harness 全包进macOS 桌面
Cetus:把 Claude Code、Codex、DeepSeek Harness 全包进macOS 桌面,它不打算取代 Claude Code、Codex、DeepSeek Harness,而是给它们补上"不适合待在终端里"的那一层。
分工清晰:agent runtime 管智能和执行,cetus桌面这层套壳管入口、环境 context、调度和审阅。
四件主打功能,都很"桌面":
① Quick Launcher:双 ...
最近用Grok的频率开始高于ChatGPT,说实话Grok的好用程度绝对是超乎很多人预期的
最近用Grok的频率开始高于ChatGPT,说实话Grok的好用程度绝对是超乎很多人预期的,特别近几个月上了Bot和Build功能后,干活能力直线拉升。
我甚至在手机上做各种office文档,很多skill、插件安装即用,完全不用电脑。
不知道是不是我个人感觉,还是大家也是这样,我用下来Grok的速度出奇的快,特别是检索其他网站资料、配 ...
单卡5090跑满血DeepSeek V4Flash,已开源,Token自由了!
编辑 | 泽南「这个结果太疯狂了。」本周五,AI 社区热烈讨论的是一个端侧大模型部署技术,它能让笔记本 RTX 4060 跑 Qwen 3.6-35B,桌面 RTX 5090 跑得起 DeepSeek-V4-Flash 284B。而且都是单卡,模型都是满血的。
Codex 生产 trace 的中位 decode 速度是 33 token/s,笔记本 RTX 4060 跑 Qwen3.6-35B 的 39.3 token/s 已 ...
FreeToken:让你的游戏本变身顶级AI工作站
【FreeToken:让你的游戏本变身顶级AI工作站】伯克利与MIT团队发布的FreeToken打破了“大模型必须堆显存”的硬件迷信。它通过带宽自适应的CPU-GPU协同执行和语义感知缓存技术,让普通设备也能流畅运行顶级开源模型:8GB显存的4060笔记本能跑Qwen 3.6 35B,单张5090能驱动284B的DeepSeek-V4-Flash,甚至753B的GLM-5.2也能在 ...
更智能地工作,节省时间,提升效率,专业版和免费版均包含九大功能。
更智能地工作,节省时间,提升效率,专业版和免费版均包含九大功能。
自定义指令:专业版只需设置一次偏好,即可获得更优质、更相关的答案;免费版无需额外设置,即可在每次聊天中使用。交互式输出:专业版可创建文档、代码、图表和设计,您可直接在 Claude 中编辑;免费版允许您在聊天中查看和使用这些输出。长篇上下文理 ...
我向 ChatGPT、Gemini 和 Claude 提出了同样的问题。这三个平台都给了我完全相同的答案:
我向 ChatGPT、Gemini 和 Claude 提出了同样的问题。这三个平台都给了我完全相同的答案:
“如果我使用免费套餐,哪个 LLM 最好?”
ChatGPT 始终名列榜首。
Claude 和 Gemini 甚至分别排在第二和第三。
我亲自测试了这个答案,在所有这些 AI 工具上都创建了一个新的(免费)账户。
我每月在 AI 上的花费超过 1000 美 ...
**Claude AI 速查表**
**Claude AI 速查表**
事半功倍。工作更高效。构建一切。
简洁明了的一页。你真正需要的所有提示技巧。
选择合适的模型。掌握最佳提示公式。使用现成模板。解锁 Claude 的超能力。连接你的工具。遵循专业工作流程。避免常见错误。
保存并使用它。提升每次聊天体验。
...
想要既快速又精准地生成音频?AudioX-Turbo 这次给出的答案确实非常直接。
想要既快速又精准地生成音频?AudioX-Turbo 这次给出的答案确实非常直接。
它没有采用零散的修补方式,而是重新设计了一个统一的“万物皆可音频”生成框架。无论你输入什么——文本、视频、音频,或是它们的任意组合——它都能输出高质量的声音,无论是超逼真的音效还是旋律优美的音乐,都能轻松应对。
更重要的是,它将 ...
分享
1. http://Claude.ai (solve any problem)
2. http://Remove.bg (remove backgrounds)
3. http://Perplexity.ai (research anything)
4. http://Suno.ai (compose music)
5. http://Lovart.com (design graphics)
6. http://Voicebox.sh (clone voices)
7. http://Notebooklm.google (perfect note)
8. http://Youm ...
Karpathy 提出的“LLM Wiki”概念终于有了极其专业的开源实现:claude-obsidian。
Karpathy 提出的“LLM Wiki”概念终于有了极其专业的开源实现:claude-obsidian。
这并非简单的提示或插件,而是一个严谨的、本地优先的知识工程系统:
🔹 真正的本地所有权:纯 Markdown + JSON 存储,绝不将知识锁定在专有数据库或私有云中。
🔹 严格的事务和竞态条件预防机制:多代理并行生成草稿,配合 Orchestrator ...
6个月人工智能工程师路线图
兄弟,我们挖到了一个免费的蹭币库,无限野生向导,赶紧去试试!
兄弟,我们挖到了一个免费的蹭币库,无限野生向导,赶紧去试试!
GitHub 上有人做了一个项目,它基于 Claude Code 的外壳,但背后的驱动力并非 Anthropic,而是 DeepSeek 和 Kimi 等免费配额提供商。
它声称支持 49 个资源,每月可以抓取 13 亿个代币,设置只需几分钟,而且已经获得了 4.6 万多个星标。
重点:它不是免 ...
Claude的“努力值”罗生门:当推理变成一种昂贵的消耗品
【Claude的“努力值”罗生门:当推理变成一种昂贵的消耗品】近期大量开发者发现Anthropic在Claude Code中进行秘密A/B测试:用户选择了“高强度”推理,模型却在后台显示为“低强度”或表现得极其低效。最典型的案例是,原本两分钟能修好的配置文件,Opus 5却花了43分钟去拉取容器、跑沙盒,甚至在无关代码上反复横跳。Anthr ...
我把自己用的虚拟局域网工具开源了:MeshLAN
我把自己用的虚拟局域网工具开源了:MeshLAN
这段时间一直在折腾一个叫 MeshLAN 的项目,现在终于整理好源码,正式放到 GitHub 上了。
项目地址:
https://github.com/zhaoxuya520/MeshLAN
最初做它的原因其实很具体。
我本机开着一些只监听 localhost 的服务,比如 API、Web 管理页面和开发工具。我想让不在同一个地方的朋 ...
GPT-5.6 刚刚宣布再次降价 20%——以下是一些看法:
GPT-5.6 刚刚宣布再次降价 20%——以下是一些看法:
1)这显然是再次针对 Anthropic。Anthropic 目前处境艰难:Opus 5 的声誉一落千丈,Fable 5 对订阅用户的速率限制也饱受诟病。在这个关键时刻降价,不仅拉大了价格差距,还巧妙地将自身定位为“更具性价比的选择”——时机把握得恰到好处。
2)这也表明 OpenAI 早期在 ...
截至 2026 年 8 月,GitHub 上 12 个最受欢迎的技能代码库。 你最喜欢哪个?