Responses
OpenAI Responses API family 的 Responses operation。
Responses 是 OpenAI API family 的原生 wire 调用入口
Responses operation 使用 /v1/responses,不是 Chat Completions 的别名。OpenAI 新项目和 Codex 类工具通常优先看这个入口;模型商品、usage 字段和流式完成事件都按 Responses wire 处理。
不支持服务端 Responses 续链
当前不支持非空 previous_response_id。请不要依赖服务端保存的 Responses 状态;客户端应在每次请求中携带完整上下文(例如完整的 input)。携带非空值会在内容过滤、计费、选路和上游调用前返回 400 unsupported_parameter。省略该字段是推荐写法;null 或空白字符串仅作为兼容输入接受。
路径
| 用途 | 方法与路径 |
|---|---|
| 模型调用 | POST /v1/responses |
请求示例
curl https://dingjiai.com/v1/responses \
-H "Authorization: Bearer YOUR_USER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "Responses 可用的 public model id",
"input": "用一句话说明 Responses 接口适合什么场景"
}'流式请求
curl -N https://dingjiai.com/v1/responses \
-H "Authorization: Bearer YOUR_USER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "Responses 可用的 public model id",
"stream": true,
"input": "分三步说明如何排查 API 调用失败"
}'服务端正常读到完成事件时,流式 Responses 会优先从完成事件里的 response usage 提取用量。已交付至少一个上游/model chunk 后,上游断流或客户端取消仍记录失败原因,但会按已收集 partial usage 或输出下限结算;usage 缺失/无效时,按 token 计费的商品可能使用保守下界估算。
Search 能力
Responses 场景中的 Codex 可能按需使用 Search。对客户端来说,这是 Responses 工作流的一项能力,不需要新增协议、模型或鉴权配置。当前 Codex 客户端可能为此额外发出 POST /v1/alpha/search 传输请求,8788 只做同一主链下的透明转发;该请求不单独产生 usage、预留或账本扣费,后续 Responses 请求仍按本页的正常 usage 规则结算。
不要脱离原始 Codex 会话手工拼接 Search 响应或 function_call_output;Search 请求需要客户端生成的上下文和调用标识。Search 默认复用 Responses 上游候选,实际参数支持由上游决定。
请求字段
Prop
Type
usage 与计费
结算读取 usage.input_tokens、usage.output_tokens,以及可选的 usage.input_tokens_details.cached_tokens。
服务端不会采信客户端自行估算的 token 数。保守估算只在响应内容可确认有效且商品适用按 token 计费时启用;无法安全估算时仍按失败关闭。
Responses 以当前调用入口的模型商品为准
当前没有对外的 /v1/responses 专用模型列表。接入 Responses 时,请使用平台或管理员明确开放给 Responses 调用入口的 public model id;不要把 GET /v1/models 返回的 Chat Completions 模型商品直接视为 Responses 可用。
最后更新于