Claude 使用手册
独立第三方资料站 · 非 Anthropic / Claude 官方网站查阅条件,核对证据
使用指南

自适应思考与手动 Extended Thinking 有何区别

分别理解模型自主分配推理、努力程度和旧式token预算,避免复制不兼容配置。

先区分三个概念

自适应思考是让模型根据请求决定是否以及如何投入推理;effort用于表达投入程度的倾向;旧式手动Extended Thinking则使用budget_tokens。它们不是同一个字段的三种名称,也不能把网页端的开关直接翻译为所有API版本的相同参数。

为什么旧配置可能失效

现行官方迁移说明指出,4.6的手动预算模式已弃用,4.7及之后的相关型号不再接受旧式enabled配置。相反,仍只支持旧式思考的型号不能随意改成adaptive。开始前应按具体模型和平台查支持矩阵,不能仅把“最新思考代码”复制到任何旧型号。

一个明确的迁移例子

在支持自适应思考的Sonnet4.6请求中,官方建议用thinking.type为adaptive,并将投入程度放在output_config.effort,而不是继续传budget_tokens。下面只是结构片段,缺少消息等完整请求字段,不是可以直接运行的应用,也不表示已经在线测试。

json · 示例
{
  "model": "claude-sonnet-4-6",
  "thinking": {
    "type": "adaptive"
  },
  "output_config": {
    "effort": "high"
  }
}
来源核对过的配置片段;JSON语法有效,未发送请求。

行为变化也需要验证

从固定预算改为自适应后,简单请求可能直接作答,不能假设每次响应都有思考块。解析器应处理不同内容块和空缺的情况;有工具参与时,按照官方规则保留历史内容,不能为缩短上下文擅自改写签名或思考块。

如何选择投入程度

准备两组任务:规则明确的工单字段提取,以及存在多项约束的排班方案。先用默认设置建立质量基线,再调整投入程度,分别观察错误、token与完成时间。排班题要有独立约束检查,字段提取要有人工答案;更长的解释不等于更好的结果。

成本与发布前检查

把思考、最终输出、上下文和工具调用相关用量纳入预算;参数变化还可能影响缓存,不能把一次实验的费用视为固定价格。核对模型支持、字段位置、响应解析、历史保留和失败处理后再切换。本文说明两种机制及迁移方法,不承诺开启思考即可解决资料不足或保证正确。

参考来源

资料核对日期:2026-10-04。涉及产品与账户条件时,请以当前官方说明为准。