这事看起来挺别扭。V4 Flash、GLM-5.3 Flash、Qwen 那一档,价格压得很低,但是工作能力一点也不差。
日常的比如:改改文件、跑个脚本、补一下测试用例,应付日常的简单任务基本上没啥问题。
可是一到真正用的时候,大多数人还是把默认思考深度开到最大:工具先挂一串,系统提示词写得很长,Plan、Sub-agent、浏览器、记忆层一起上。
我越来越觉得,Flash 要配的不是更全的产品,是更薄的那一层。Pi 刚好站在这个位置上。
1、Flash 怕的不是能力不够,是指令太吵
便宜模型现在真正的短板,往往不是写不出代码,是上下文一脏就容易空转。工具一多,它更爱反复读同一批文件,参数写飘,同一件事绕三圈。重壳把这些能力全摊在默认环境里,对 Opus 也许是锦上添花,对 Flash 更像噪音。
Pi 默认就四件事:read、write、edit、bash。系统提示词压得很短。Skill、Extension、Package 都在,只是不预先替你打开。这对 Flash 很关键。它每轮能看见的东西变少,注意力才回得来,便宜才有意义。
2、轻壳是在保护它的价格,不是在减功能
Flash 之所以叫 Flash,不只是快,是单价允许你多跑几轮。V4 Flash 这类模型,输入可以低到大约 0.14 美元 / 百万 Token,上下文还拉得很长。可壳一厚,每轮都把长前缀、闲工具描述、额外人格说明送进去,省下来的那截会先被环境吃掉。
有人拿同一颗 DeepSeek V4 Flash,在不同 Harness 里跑过同一组偏真实的任务。换的不是模型,是壳。Pi 做完的题更多,单次成功大概 0.028 美元;更重的那套默认工作流,单次成功可以到 0.195 美元左右。七倍不是模型智商差出来的,是每轮到底塞了多少东西进去。
所以我会把搭配记成一句话:Flash 负责把活做完,Pi 负责别把活做贵。
3、复杂仍然外挂,只是默认不交给 Flash
轻不等于简陋。浏览器、审查、子代理、仓库导航,需要时再挂。Flash 适合扫仓、改测试、跑脚本、按已经写清的文件往下改。定方案、碰架构、最后过目,还是切回更重的模型。
Pi 在这里的好处不是又多了一个 Flash 开关,是同一条 Session 里切模型的成本低。Flash 跑到卡住,再把那一轮交给 Opus 或者 Pro,不必换一家产品,也不必把整套默认插件先背起来。
日常总结下来:
日常循环:V4 Flash 或 GLM-5.3 Flash + Pi 裸配置
备用:同一 Session 里切一颗重模型看方案
先别做:Flash 一上手就叠最全的默认插件
Pi 核心有一句话 不该进核心的东西就不进 Core,这个问题和便宜模型碰到一起,才真正开始省钱。