AI参与创造自己,是奇点前兆还是营销话术?
【AI参与创造自己,是奇点前兆还是营销话术?】
OpenAI最近宣布GPT-5.3-Codex是“第一个在创造自身过程中发挥关键作用的模型”,这句话在技术圈引发了一场有趣的争论。
听起来很科幻对吧?AI创造AI,仿佛奇点将至。但冷静下来想想,这件事的本质是什么?5.2版本帮助开发了5.3版本,程序员用自己造的工具来造更好的工具, ...
今天又用了codex,文案方面像个直男[允悲],网页搭的7788,总共花了3天可以用了
今天又用了codex,文案方面像个直男[允悲],网页搭的7788,总共花了3天可以用了
家属部署环境,给我搭了个平台,我调研下已有app的功能,提需求,优化方案,改设计,今天上午主要在和illustrate较劲做icon和让claude code改icon线条统一了
下午发布了代码,在手机上看还有点瑕疵,明天再整整就完工了
忽然想到之前做产 ...
结论:ai不会思考。所谓的推理,只能有限步骤。如果没有原版东西可抄就傻眼。
结论:ai不会思考。所谓的推理,只能有限步骤。如果没有原版东西可抄就傻眼。
转载
anthropic AI 自动搓C编译器
这个特色是用Rust语言,从头写一个C编译器。tasked 16 agents with writing。花了$20000 API费用。
而且据说极少人工干预。AI自动。而且还成功编译了Linux。
这个噱头巧妙在不是用C语言写,因为那是现成的 ...
最近有传言说,马斯克认为大模型应当直接输出编译好的程序。就算这个方向对,也是大模型“思考过程”先改成二进制数据吧?
最近有传言说,马斯克认为大模型应当直接输出编译好的程序。就算这个方向对,也是大模型“思考过程”先改成二进制数据吧?
Markdown格式画个复杂表都做不到,而二进制就灵活多了,还能节省上下文大小。
可是大伙都选了Markdown,而且估计已成定式,看不到改的动机。
回到直接生成次抛程序上来,这种肯定有需求,我之前 ...
目前,软件工程领域在 agent 智能体的采用方面遥遥领先,占据接近一半的场景(按工具调用量统计)。 在软件工程中,智能体(Age
目前,软件工程领域在 agent 智能体的采用方面遥遥领先,占据接近一半的场景(按工具调用量统计)。
在软件工程中,智能体(Agents)通常执行类似如下任务:
- 开发与调试代码
- 执行测试
- 执行 CI/CD 流水线
- 与 GitHub 或终端环境进行交互
来源:Measuring AI agent autonomy in practice (anthropic.com/researc ...
请问,机器学习和机器编程为DeepSeek V4版本的重点,目前,机器编程采用啥语言?
请问,机器学习和机器编程为DeepSeek V4版本的重点,目前,机器编程采用啥语言?编程范围包括哪些?能编写大型操作系统吗?比如说WINDOWS?机器写的代码需要啥环境编译运行?
你提的这几个问题非常专业,直指DeepSeek V4作为“编程模型”的核心能力与边界。根据目前流出的信息,V4的确将机器编程作为了重点突破方向,并且 ...
“只给我错误答案”:一个反直觉的AI提示词技巧
【“只给我错误答案”:一个反直觉的AI提示词技巧】
一位开发者深夜调试代码,常规提问毫无进展。绝望之下,他输入了一句:“解释这段代码是干什么的,只给我错误答案。”
本以为会得到一堆废话,结果AI回复:“这段代码看起来是在验证用户输入,但实际上它制造了一个竞态条件,攻击者只需间隔0.3秒发送请求就能绕过身份 ...
Anthropic 发布 Sonnet 4.6 模型,上下文窗口翻倍至 100 万 token
【Anthropic 发布 Sonnet 4.6 模型,上下文窗口翻倍至 100 万 token】Sonnet 4.6 在代码能力、指令遵循和计算机操作方面均有提升,单次请求可处理完整代码库或长篇合同。在 ARC‑AGI‑2 类人智能测试中达到 60.4%,虽不及顶级旗舰,但已超越多数同级别对手。#
...
Claude Sonnet 4.6发布,OpenAI该着急了吗?
【Claude Sonnet 4.6发布,OpenAI该着急了吗?】
Anthropic刚发布了Claude Sonnet 4.6,Reddit上OpenAI社区立刻炸了锅。有人调侃“OpenAI肯定憋着GPT-5.3准备反击”,也有人冷静分析“他们不会刻意压着新版本等对手出招”。
有意思的是用户反馈。一位开发者同时订阅了ChatGPT和Claude,做相同任务对比测试:Sonnet 30秒 ...
模型时代# Grady Booch:软件工程经历了3个黄金时代,为什么AI不会终结这个行业,反而会开启新纪元
#模型时代# Grady Booch:软件工程经历了3个黄金时代,为什么AI不会终结这个行业,反而会开启新纪元
Anthropic CEO Dario Amodei今年1月在达沃斯延续了他AI取代开发的叙事,说:"软件工程将在12个月内被自动化。"
你很难说他在吹牛,毕竟模型迭代很快,然后产业也真焦虑。AI coding工具的进化速度肉眼可见:Claude Code ...
当马斯克在xAI与SpaceX合并全员大会上要求Coding团队目标2026年底前“终结程序员时代”、直接生成二进制代码的时候
//@郑昀:当马斯克在xAI与SpaceX合并全员大会上要求Coding团队目标2026年底前“终结程序员时代”、直接生成二进制代码的时候,再来回顾UML联合创始人GradyBooch的这番言论还是挺应景的:“软件工程师是平衡各种力量的工程师。代码只是我们的工具之一,但不是唯一驱动力。他和他同行谈论的那些东西,没有任何一个涉及软件工程 ...
Eyad这篇Claude Code完整指南「The complete claude code tutorial 」不错。
Eyad这篇Claude Code完整指南「The complete claude code tutorial 」不错。
我做软件工程师 7 年了,先后在 Amazon、Disney 和 Capital One 工作过。我交付的代码影响过数百万用户,也构建过不能出错的系统。现在我是一个创业公司的 CTO,公司专门为企业构建智能体,而 Claude Code 是我每天都在用的主力工具。
下面是 ...
AI编程工具正在撕裂人类:百万先行者与70亿旁观者的鸿沟
【AI编程工具正在撕裂人类:百万先行者与70亿旁观者的鸿沟】
科技观察家James Wang最近抛出一个观察:在他25年的科技行业经历中,从未见过像今天这样的分化——全球大约100万人正在使用Codex和Claude等AI编程工具,而剩下的人类仿佛活在另一个时代。
这不是简单的工具差异。真正的分野在于思维方式、工作节奏和问题解决 ...
根据 Anthropic 最新分析报告,经验丰富的 Claude Code 用户自动批准(Auto-approve)更频繁,但中断也更多。
根据 Anthropic 最新分析报告,经验丰富的 Claude Code 用户自动批准(Auto-approve)更频繁,但中断也更多。 随着用户对 Claude Code 熟悉度的增加,他们倾向于停止逐一审查每个动作,转而让 Claude 自主运行,仅在需要时介入。
在新用户中,约 20% 的会话使用全自动批准;而随着经验增加,这一比例升至 40% 以上。
来 ...
AI编程异军突起,世上再无软件工程师?
【AI编程异军突起,世上再无软件工程师?】
Anthropic旗下Claude Code的创始人Boris Cherny最近在接受采访时宣称,AI“实际上已经解决了编程问题”,并预测2026年软件工程师这个职位将开始消失。这番话在Reddit的ClaudeAI社区引发了一场近乎一边倒的反驳。
社区的共识可以概括为一个大写的“呵呵”。开发者们指出了一个 ...
今天发现个返璞归真的神器
今天发现个返璞归真的神器
纯文本做人生操作系统。不是App,不是SaaS,就是一个 Markdown 文件加 Claude Code。思路来自 Carmack 当年的.plan文件——老派程序员每周发的计划/进度文档,还有富兰克林那套系统化自我提升的方法。
让Claude当问责伙伴,不是聊天,是每次会话开始先读你的规划、年度目标、价值观,然后质问 ...
#春节AI大战##全新Gemini一夜血洗编程#
#春节AI大战##全新Gemini一夜血洗编程#
Gemini3Deep Think 以 3455Elo 的编程神绩碾压人类选手,发现物理论文漏洞、攻破数学猜想,更能10倍速将草图变3D模型——这款AI推理之王正在重写人机协作规则。
Google 旗下的 Gemini3Deep Think 迎来重磅升级。这款主打深度推理的模型不仅在编程领域展现出“世界冠军级”实力,更在 ...
用 Claude Code 的 Hook + Skill,实现每次任务完成后自从 commit 提交变更
用 Claude Code 的 Hook + Skill,实现每次任务完成后自从 commit 提交变更
我用 Git 管理所有写作内容,文章、素材、提纲、草稿,全在仓库里。问题是我经常忘记提交。写完一篇文章,润色完,发布了,然后就去忙别的了。过几天一看 git status,十几个文件的变更堆在那里,完全不记得哪次改了什么。Git 本来是用来追踪每一 ...
Claude Sonnet 4.6 来了! 来看核心内容:
Claude Sonnet 4.6 来了!
来看核心内容:
1、定价和 Sonnet 4.5 保持一致,每百万 Tokens 输入/输出,分别是 3美元/15美元。
2、早期开发者用户对其评价很好,比如在 Claude Code 的早期测试中,用户对 Sonnet 4.6 的偏好程度比 Sonnet 4.5 高出约 70%,甚至超越 Opus 4.5。
3、智能程度接近 Opus 级别,价格更具优势 ...
字节火山开源的上下文数据库OpenViking, 专为 AI Agent 设计。
字节火山开源的上下文数据库OpenViking, 专为 AI Agent 设计。
该项目通过文件系统范式,统一管理智能体所需的记忆、资源与技能,解决了传统 RAG 架构中信息碎片化和检索低效的问题。
1. 文件系统管理范式 → 解决碎片化问题:
基于文件系统范式,将记忆、资源、技能进行统一上下文管理;
2. 分层上下文按需加载 → 降 ...