排障指南 / GUIDE
OpenAI Responses API 的 reasoning.effort、text.verbosity、max_output_tokens、truncation、service_tier、prompt_cache_key 和 safety_identifier 有什么区别?
直接答案
OpenAI Responses API 的 reasoning.effort、text.verbosity、maxoutputtokens、truncation、servicetier、promptcachekey 和 safetyidentifier 有什么区别?
症状、差异与判断依据
参数 控制对象 不能替代什么
-- --- ---
reasoning.effort 推理投入 输出长度上限、服务优先级
text.verbosity 文本回答详细程度 硬 Token 上限、质量保证
maxoutputtokens 推理与可见输出的总生成上限 目标字数、输入 Context 管理
排障步骤与验证
truncation 输入超窗时截断或报错 输出截断策略、语义压缩
servicetier 请求的处理模式 模型能力、Token 限额
promptcachekey 缓存路由与命中归组 用户安全标识、Response ID
safetyidentifier 稳定的终端用户安全标识 缓存键、认证、授权
这些参数应分别通过质量、延迟、成本、安全和可恢复性指标评估,不能用一个“高性能配置”覆盖所有业务。
reasoning.effort 位于 reasoning 对象中,用于支持推理的 GPT-5 和 o-series 模型。它表达模型在回答前投入多少推理工作。
可用枚举与默认值取决于具体 Model。调用前应查看所选 Model Page 和 API Schema,不要把另一模型支持的 max、xhigh 或 none 直接照搬。
官方与规范资料
OpenAI API 错误处理OpenAI 官方文档
Responses API:Create a model responseOpenAI 官方文档