gpt-5-5
能力: 128K 上下文 · 工具调用 · 视觉 · 流式 · 结构化输出 · reasoning_effort
计价: 按 token,旗舰档(实时费率)
GPT-5.5 是 OpenAI 当前的旗舰 —— 平台上任何新项目的默认选择。它是把原生推理塞
进标准 chat completions 结构里的那款模型:同样的请求 body、同样的响应结构,
reasoning_effort 作为可选的调节项。多数生产工作里默认的 "medium" 就够;
只有在 Sonnet 或 5.4-pro 留下质量空间的硬问题上,才提到 "high"。
Request
Body 参数
Response
reasoning_tokens 按输入 token 费率计费。
代码示例
reasoning_effort
Web 搜索
传"web_search": {} 让模型获得内置的 web 搜索工具。工具按次计费(当前费率见
价格)。在事实接地任务里有用 —— 否则模型
可能幻觉或引用过期信息。
流式与缓存
"stream": true 走 SSE。开启推理时 TTFB 会更长。稳定前缀自动 prompt caching ——
这个档位上最具杠杆效应的成本优化。
Errors
何时选用
- 在 OpenAI 上启动任何新项目的默认起点。
- 在现有代码库中做代码生成、schema / API 设计。
- 多步规划、中端模型会漂移的结构化输出场景。
- 中端成本 / 延迟,见 GPT-5.4。