排障指南 / GUIDE
OpenAI Responses API 的 input_text、input_image、input_file、URL、Base64、file_id、detail 和 PDF 有什么区别?
直接答案
OpenAI Responses API 的 inputtext、inputimage、inputfile、URL、Base64、fileid、detail 和 PDF 有什么区别?
症状、差异与判断依据
概念 所在层次 主要用途 常见误区
-- --- --- ---
inputtext 内容项类型 提供文本指令或上下文 所有字符串都能自动当文件处理
inputimage 内容项类型 提供需要视觉理解的图像 它会生成或修改图像
inputfile 内容项类型 提供 PDF、文档等文件 它等同于 inputimage
排障步骤与验证
URL 内容来源 让服务获取可访问资源 浏览器能开就一定能被服务访问
Base64 / Data URL 内联内容 把二进制放进请求 Base64 会压缩文件
fileid 已上传资源引用 重用 Files API 中的文件 ID 可跨项目、无限期随意使用
detail 图像处理提示 权衡视觉细节、延迟与 token 越高对所有图片都越准确
PDF 文件格式 同时提供文字与页面视觉信息 只抽取纯文本,不产生图像成本
简单文本请求可以把 input 写成字符串。需要组合文字、图片或文件时,应使用消息与内容项数组。内容项的 type 告诉 API 如何解释该项,而不是根据字段值猜测。
结构化输入的优势是每个部分语义明确。不要把图片 URL 只塞进自然语言,希望模型自己下载;也不要把二进制字节直接放进 text 字段。
官方与规范资料
OpenAI API 错误处理OpenAI 官方文档
Responses API:Create a model responseOpenAI 官方文档