
这篇发文是 Claude Code 团队工程师 Thariq Shihipar 9 月 25 日发在 claude.dev 的博客《Using Claude Code: Spending your effort》(https://claude.dev/blog/spending-your-effort/),”头脑风暴用 low”出现在文末的档位清单里,原话是 “Low: for when I want quick responses that are in the loop, e.g. brainstorming, sketching, easy changes”。翻一下 Anthropic 的 API 文档会发现一个容易被忽略的细节,low 档的官方定位是”简单分类、快速查找、高吞吐场景”,通篇没提头脑风暴。把发散式讨论归入低档,是这位工程师基于自己使用经验的工程判断,属于实践智慧而非文档规范。不过这个判断站得住,博客自己的数据和公开文献都能给出支撑,而且支撑它的理由不依赖 Claude 的任何私有特性。理解这条建议首先要弄清 effort 加上去到底改变了什么。按 Anthropic 文档的定义,它控制模型在整个响应上投入的工作量,具体落在三处,思考的频率和深度、工具调用的数量、以及替用户做决定的幅度。低档时模型倾向于合并操作、少调工具、直接行动;高档时它会先解释计划、多调工具、事后写详细总结,几乎每个请求都触发长思考。换句话说,档位调高之后模型多做的事情相当具体,是更彻底的自我验证和更大范围的自主补全,智力本身并没有变化。博客里 Terminal-Bench 3.0 的失败分类对这种增量给出了量化答案。Fable 5.1 在 370 次尝试上从最低档拉到最高档,通过数由 140 升至 214,增量几乎全部来自漏检型失败的消失,”测试没抓到的 bug”从 40 次降到 14 次,”不完整的修复”从 31 次降到 10 次;方向性错误没有同步减少,”选错解读”的次数反而从 25 升到 47。作者的结论也只有一句,增加 effort 能减少因遗漏边界情况导致的失败,救不了读错题。图 1 把这 370 次尝试的失败类型位移画了出来,降幅集中在验证类失败,唯一不降反升的是”选错解读”。Fable 5.1 在 Terminal