自适应思考与手动 Extended Thinking 有何区别
分别理解模型自主分配推理、努力程度和旧式token预算,避免复制不兼容配置。
先区分三个概念
自适应思考是让模型根据请求决定是否以及如何投入推理;effort用于表达投入程度的倾向;旧式手动Extended Thinking则使用budget_tokens。它们不是同一个字段的三种名称,也不能把网页端的开关直接翻译为所有API版本的相同参数。
为什么旧配置可能失效
现行官方迁移说明指出,4.6的手动预算模式已弃用,4.7及之后的相关型号不再接受旧式enabled配置。相反,仍只支持旧式思考的型号不能随意改成adaptive。开始前应按具体模型和平台查支持矩阵,不能仅把“最新思考代码”复制到任何旧型号。
一个明确的迁移例子
在支持自适应思考的Sonnet4.6请求中,官方建议用thinking.type为adaptive,并将投入程度放在output_config.effort,而不是继续传budget_tokens。下面只是结构片段,缺少消息等完整请求字段,不是可以直接运行的应用,也不表示已经在线测试。
{
"model": "claude-sonnet-4-6",
"thinking": {
"type": "adaptive"
},
"output_config": {
"effort": "high"
}
}行为变化也需要验证
从固定预算改为自适应后,简单请求可能直接作答,不能假设每次响应都有思考块。解析器应处理不同内容块和空缺的情况;有工具参与时,按照官方规则保留历史内容,不能为缩短上下文擅自改写签名或思考块。
如何选择投入程度
准备两组任务:规则明确的工单字段提取,以及存在多项约束的排班方案。先用默认设置建立质量基线,再调整投入程度,分别观察错误、token与完成时间。排班题要有独立约束检查,字段提取要有人工答案;更长的解释不等于更好的结果。
成本与发布前检查
把思考、最终输出、上下文和工具调用相关用量纳入预算;参数变化还可能影响缓存,不能把一次实验的费用视为固定价格。核对模型支持、字段位置、响应解析、历史保留和失败处理后再切换。本文说明两种机制及迁移方法,不承诺开启思考即可解决资料不足或保证正确。
参考来源
资料核对日期:2026-10-04。涉及产品与账户条件时,请以当前官方说明为准。