Extended Thinking 怎样使用 先确认入口与模型
介绍聊天设置、API手动模式和迁移边界,并用可检查的任务决定是否增加推理投入。
什么任务值得尝试
多步数学、复杂代码排查和需要比较约束的方案,可以作为增加思考投入的候选。若只是改写已有句子或提取一个明确字段,先用默认设置。任务缺材料时,先补资料;思考设置不会使不存在的来源变成事实,也不能代替最终验收。
聊天端看当前实际设置
官方聊天帮助把模型、effort和thinking分别说明。可调整的选项取决于所用模型;一些型号不提供关闭思考的选择。因此找不到旧截图里的开关,不能立即认定账号异常。按模型菜单中的实际设置操作,组织管理及产品更新也可能影响界面。
API旧式模式的边界
手动Extended Thinking使用enabled与budget_tokens,当前文档将其列为旧式模式。它的预算与max_tokens存在约束及特定例外,需要按具体型号查文档。不要把budget_tokens理解成所有成本的硬上限,也不要把适用于旧版的请求与新版字段混装。
实际接入时怎样选择
先确认模型支持哪种思考方式,若支持且推荐adaptive,则按当前迁移说明使用自适应方式和effort控制。保留服务端返回的内容结构,分别处理文本、工具与其他块。不能假设第一块必然是最终文字,更不能为了获得所谓完整思维链而绕过产品的输出边界。
用可复算任务检验收益
原创练习是安排三位人员的值班:甲不能周三、乙不能连续两天、每天恰好一人。要求给出排班并列出约束检查。人工或小脚本逐项验证,比单看解释长短更有效。比较不同设置时保持材料与规则一致,记录失败类型和总用量;本文没有运行模型对照。
上线前检查清单
检查接口是否接受设置、错误能否清楚回传、超时和预算是否有效、历史与工具结果是否按要求保留。核验重要计算或代码,记录实际模型和日期。不要因输出含思考摘要就认定结论正确,也不要承诺任何型号都能手动打开或关闭相同模式。
参考来源
资料核对日期:2026-10-04。涉及产品与账户条件时,请以当前官方说明为准。