AIERROR故障诊断台
排障指南 / GUIDE

OpenAI Responses API 的 reasoning.effort、text.verbosity、max_output_tokens、truncation、service_tier、prompt_cache_key 和 safety_identifier 有什么区别?

核验更新:2026-08-26证据状态:VERIFIED

直接答案

OpenAI Responses API 的 reasoning.effort、text.verbosity、maxoutputtokens、truncation、servicetier、promptcachekey 和 safetyidentifier 有什么区别?

症状、差异与判断依据

参数 控制对象 不能替代什么

-- --- ---

reasoning.effort 推理投入 输出长度上限、服务优先级

text.verbosity 文本回答详细程度 硬 Token 上限、质量保证

maxoutputtokens 推理与可见输出的总生成上限 目标字数、输入 Context 管理

排障步骤与验证

truncation 输入超窗时截断或报错 输出截断策略、语义压缩

servicetier 请求的处理模式 模型能力、Token 限额

promptcachekey 缓存路由与命中归组 用户安全标识、Response ID

safetyidentifier 稳定的终端用户安全标识 缓存键、认证、授权

这些参数应分别通过质量、延迟、成本、安全和可恢复性指标评估,不能用一个“高性能配置”覆盖所有业务。

reasoning.effort 位于 reasoning 对象中,用于支持推理的 GPT-5 和 o-series 模型。它表达模型在回答前投入多少推理工作。

可用枚举与默认值取决于具体 Model。调用前应查看所选 Model Page 和 API Schema,不要把另一模型支持的 max、xhigh 或 none 直接照搬。

官方与规范资料

OpenAI API 错误处理OpenAI 官方文档

Responses API:Create a model responseOpenAI 官方文档