Skip to main content
Responses API 形状(OpenAI 为 o1 / o3 / GPT-5 + Agents SDK 引入)—— 由 ByteSpike 像其他端点一样计费和服务。底下网关把 Responses 形状的请求翻译 成各模型的原生协议,所以你可以把 OpenAI SDK + Agents SDK + Codex CLI 指向 ByteSpike,让它跑在 Claude、Gemini、DeepSeek 等模型上。

何时使用

  • OpenAI Agents SDK —— SDK 默认讲 Responses 形状
  • Codex CLI —— 内部用 Responses;ByteSpike 通过 --responses-base-url https://llm.bytespike.ai/v1 直接接入
  • 多轮 agent + 结构化输出 —— response_format 加 reasoning 块装在同一个信封里
  • 跨模型一致 —— 你想要一种客户端形状打通 o-series、GPT-5 和 Claude 家族
只是普通聊天、不需要 reasoning 步骤的话,优先用 /chat/completions。要 Anthropic 原生的 tool_use + cache_control,用 /messages

请求

请求头

Body(精选字段)

Responses API 字段众多;ByteSpike 把完整 schema 转发给你请求的 model。常用字段:

响应

响应字段

计费类请求头

与其他端点一致的配额信封:
详见 API 参考总览

流式

带上 "stream": true
SSE 流逐字节兼容 OpenAI Responses 的流式协议 —— response.createdresponse.output_text.deltaresponse.completed 等。

跨模型路由

同一种 Responses 请求形状可打目录里每个模型。按 model 字段选择: 翻译路径保留 tool_use / tool_calls、结构化输出(response_format)和 reasoning tokens。不论用哪个模型,你拿到的输出形状始终是 Responses-API。

错误

OpenAI 信封(与 OpenAI Responses 规范一致):

价格

按 1k token 计费。与该模型在原生端点的价格相同 —— 翻译开销不计费。 价格实时卡片:bytespike.ai/pricing

相关