GPT-6 Astra 发布的同时,OpenAI 也开始把「怎么管一个长时 Agent」直接写进 API 设计里了,推荐这篇新的使用指南。
慢工具可以异步跑,模型不用原地等;任务跑到一半可以直接插话改需求;同一个 Session 里还能随任务难度动态调整 reasoning effort,同时尽量保住 Cache。
我比较喜欢后面的 Prompting 部分。OpenAI 也直接把 Astra 的一些「脾气」写出来了:
它会容易停下来问问题、对 Skills 和 AGENTS.md 更敏感、可能不够主动分 Subagent,Coding 时还有点容易验证过头。
所以模型能力继续往长任务走之后,Harness 也开始需要更细的控制了。什么时候继续、什么时候插手、什么时候多想一点、哪些指令优先,这些都逐渐变成正式的 API 能力。
https://developers.openai.com/api/docs/guides/latest-model?model=gpt-6-astra