最近很多海外开发者实测的体感都是,只要不写复杂算法,把思考档位切到 Low 才是 Astra 综合体验最舒服的。
Reddit 上也有很多人把 Low 评为日常任务的甜点位,对于原生能力强如 Astra 这样的模型,过度堆高思考深度,边际效益递减极快。
Astra 的思考调到 Low 有三个好处。
一是反应极快,响应逼近 Flash,模型不会频繁内耗,能迅速脱口而出给结论。
二是减少过度思考,把省下的算力留给人机交互,人的即时输入比模型后台硬想要管用。
三是底座规划和工具调用足够强,普通任务不需要过度推理,还能省点 token。
#