推理强度

Effort

Effort 是一个调节模型在回答前做多少推理的旋钮。每次模型请求单独设置,它控制模型在开始写出你能看到的回复之前,所进行的思考长度。这种思考和其他内容一样是在推理时生成的;Harness 通常会隐藏它,但模型确实在做这些工作。

更高的 effort 更贵、更慢。推理以 Token 形式输出,即使你看不到,也会按输出 Token 计费,并且是一个 Token 一个 Token 生成的——所以提高 effort 会延长等待答案的时间并增加账单。权衡的是更多斟酌与速度和成本。

大多数 Harness 把 effort 表示为几个小档位:

档位适用场景
机械性编辑、查找、路径明确且只有一条清晰路径的改动。
日常编码——通常的默认值。
棘手的 bug、设计决策、多步规划。
最高最难的问题,一旦答错,回滚成本很高。

设置不当的症状是双向的。在难题上设得太低,会得到一个自信但肤浅的答案,跳过了问题所需的推理——读起来没问题,但错在会让你之后付出代价的地方。把一行的重命名任务设为最高档,你会坐视一段漫长的思考,而最低档也能得到同样的结果。

按任务而非按 session 来匹配 effort。在真正需要费力推理的部分调高,在周围的机械性工作上调低。

用法:

“它一直搞砸这个并发修复——我已经重新解释三遍了。”

“把 effort 调高点。这是个重推理的 bug,在默认设置下,它在选定方案前思考得不够久。”