TiDBA API

模型思考等级怎么选

推理等级控制模型在回答前投入的计算强度。等级越高不代表响应越快,也不保证所有任务都会得到等比例提升。

更新于 2026-07-24预计阅读 6 分钟

当前支持的等级

平台接受的标准值为:

minimal
low
medium
high
xhigh
max

max 是当前 GPT-5.6 系列可使用的最高档。对于不原生支持 max 的模型,兼容层会按该模型可用的最高档处理,通常落到 xhigh

ultra 不是当前接口使用的标准值。某些客户端可能把最高档显示成 Ultra,但向接口发送时应使用 max,或者确认客户端是否已经替你完成映射。

各等级的实际区别

等级适合任务响应与消耗
minimal格式转换、极短回答、机械处理思考最少,适用模型有限
low简单问答、小范围代码修改通常更快、消耗较低
medium普通开发任务、解释和总结速度与质量较均衡
high代码分析、多步骤问题首个输出可能更慢
xhigh复杂调试、架构分析、长任务推理时间和输出消耗通常更高
maxGPT-5.6 的高难度代理和推理任务最高计算档,不适合每个请求默认开启

选择建议

  • 普通聊天和小修改从 medium 开始。
  • 日常 Codex 编码任务优先使用 highxhigh
  • 只有任务确实复杂、前一档结果不足时再使用 max
  • 比较等级时保持模型、输入、上下文和工具权限一致。
  • 不要只比较总耗时,同时观察首 Token、成功率、输出质量和实际消耗。

长上下文任务的耗时不只由推理等级决定。上下文长度、缓存命中、工具调用、上游容量和网络状态都会影响结果。

Codex CLI 配置

~/.codex/config.toml 中使用 model_reasoning_effort

model = "gpt-5.6-sol"
model_reasoning_effort = "xhigh"

确认当前模型支持后,可改成:

model = "gpt-5.6-sol"
model_reasoning_effort = "max"

完整的 Base URL 和提供方配置见 Codex CLI 自定义 API 教程

Responses API 配置

直接调用 Responses API 时,在 reasoning.effort 中指定:

{
  "model": "gpt-5.6-sol",
  "reasoning": {
    "effort": "xhigh"
  },
  "input": "分析这段代码中的并发问题。"
}

平台也会记录最终请求的思考等级。遇到结果与预期不一致时,以用量记录和实际请求体为准,不以客户端按钮名称推断。

常见误区

max 一定比 xhigh 更好吗

不一定。简单任务可能没有明显改善,反而增加等待和消耗。应根据任务难度逐档提升。

max 和 ultra 是两个不同档位吗

在当前 TiDBA API 的 OpenAI 兼容接口中,最高标准值是 max,没有额外的 ultra 档位。

为什么配置 max 后记录成了 xhigh

通常是所选模型不原生支持 max,兼容层将它限制为该模型可用的最高等级。

从 xhigh 开始实测

固定同一任务比较结果,再决定是否需要 max。

注册并测试