1 USD = 1,000,000 credits(micro-USD 精度)。token 费率按每百万
token 报价。每次调用的费率按美元报价。
费率怎么算
本文档每一行都是该模型在 ByteSpike 的公开费率,每晚刷新。如果你需要 程序化访问同一份数据,直接打GET /api/pricing(返回的 JSON 数组与
下面表格行一一对应)。
缓存定价约定:
- Cache write:大多数模型按 input 费率计费;Claude 模型按 1.25× input 计费。
- Cache read:一套独立、更低的逐模型费率 —— 因模型而异,见各行(并非全局统一 10%)。
- Web search 工具(支持的模型):按每千次使用单独计费的附加项。
文本模型(15 款)
OpenAI(3 款)
GPT-5.5 web-search 工具:$10 / 1k 次(单独计费)。
Anthropic(5 款)
Claude Opus 4.8 web-search 工具:$10 / 1k 次(单独计费)。
Google(2 款)
国产 LLM(5 款)
DeepSeek(2 款)
Moonshot(1 款)
Zhipu(1 款)
MiniMax(1 款)
图像模型
同步端点。按生成的每张图计费。n>1 时每张图单独计费。提供的图像模型:
GPT Image 2(OpenAI)、Nano Banana Pro 和 Nano Banana 2(Google)。
完整且权威的逐图费率表(含
nano-banana-pro)发布在
bytespike.ai/pricing#image。
视频模型
走异步/tasks/submit → /tasks/query。纯按输出秒数计费 —— 没有提交费。
queued 状态下取消免费;进入 running 后取消按已渲染的秒数部分计费。
提供的视频模型:Veo 3.1、Veo 3.1 Fast、Veo 3.1 Lite(Google)。
完整的逐秒费率表(含
veo3-1-lite)发布在
bytespike.ai/pricing#video。
工具端点
价格说明
- 失败不计费。 任何非 2xx 响应都免费。唯一的例外:视频任务在
running之后被取消 —— 已消耗的 GPU 秒数会计费。 - Cache write 费率:大多数模型按 input 费率计 cache write。 Claude 模型按 1.25× input 计 cache write。
- Cache read 费率:一套独立、更低的逐模型费率 —— 因模型 而异,见各行(并非全局统一 10%)。
- Web search / grounding 工具(支持的模型):按每千次使用 单独计费,与 token 用量分开计。
- 图像 / 视频任务失败:任务级别 100% 退款。
- Chat 5xx:不计费;网关在最外层做了自动重试。
程序化访问
updated_at 字段
告诉你该费率最近一次刷新的时间。