模型思考等级怎么选
推理等级控制模型在回答前投入的计算强度。等级越高不代表响应越快,也不保证所有任务都会得到等比例提升。
当前支持的等级
平台接受的标准值为:
minimal
low
medium
high
xhigh
max
max 是当前 GPT-5.6 系列可使用的最高档。对于不原生支持 max 的模型,兼容层会按该模型可用的最高档处理,通常落到 xhigh。
ultra 不是当前接口使用的标准值。某些客户端可能把最高档显示成 Ultra,但向接口发送时应使用 max,或者确认客户端是否已经替你完成映射。各等级的实际区别
| 等级 | 适合任务 | 响应与消耗 |
|---|---|---|
minimal | 格式转换、极短回答、机械处理 | 思考最少,适用模型有限 |
low | 简单问答、小范围代码修改 | 通常更快、消耗较低 |
medium | 普通开发任务、解释和总结 | 速度与质量较均衡 |
high | 代码分析、多步骤问题 | 首个输出可能更慢 |
xhigh | 复杂调试、架构分析、长任务 | 推理时间和输出消耗通常更高 |
max | GPT-5.6 的高难度代理和推理任务 | 最高计算档,不适合每个请求默认开启 |
选择建议
- 普通聊天和小修改从
medium开始。 - 日常 Codex 编码任务优先使用
high或xhigh。 - 只有任务确实复杂、前一档结果不足时再使用
max。 - 比较等级时保持模型、输入、上下文和工具权限一致。
- 不要只比较总耗时,同时观察首 Token、成功率、输出质量和实际消耗。
长上下文任务的耗时不只由推理等级决定。上下文长度、缓存命中、工具调用、上游容量和网络状态都会影响结果。
Codex CLI 配置
在 ~/.codex/config.toml 中使用 model_reasoning_effort:
model = "gpt-5.6-sol"
model_reasoning_effort = "xhigh"
确认当前模型支持后,可改成:
model = "gpt-5.6-sol"
model_reasoning_effort = "max"
完整的 Base URL 和提供方配置见 Codex CLI 自定义 API 教程。
Responses API 配置
直接调用 Responses API 时,在 reasoning.effort 中指定:
{
"model": "gpt-5.6-sol",
"reasoning": {
"effort": "xhigh"
},
"input": "分析这段代码中的并发问题。"
}
平台也会记录最终请求的思考等级。遇到结果与预期不一致时,以用量记录和实际请求体为准,不以客户端按钮名称推断。
常见误区
max 一定比 xhigh 更好吗
不一定。简单任务可能没有明显改善,反而增加等待和消耗。应根据任务难度逐档提升。
max 和 ultra 是两个不同档位吗
在当前 TiDBA API 的 OpenAI 兼容接口中,最高标准值是 max,没有额外的 ultra 档位。
为什么配置 max 后记录成了 xhigh
通常是所选模型不原生支持 max,兼容层将它限制为该模型可用的最高等级。
从 xhigh 开始实测
固定同一任务比较结果,再决定是否需要 max。