$5
价格
每个模型,官方价 vs 我们的价。
26 个前沿模型,覆盖 8 家厂商,一把 key 通用 —— Anthropic · OpenAI · Google · DeepSeek · 豆包 · GLM · Kimi · MiniMax。Claude 低至 1.8折;DeepSeek · 豆包 · GLM · Kimi 统一 半价;OpenAI 文本与 Gemini 原价直供。以美元计价。在线充值或用兑换码激活,调用失败不计费。
相对官方的折扣
前沿模型,远低于官方报价。
我们把每家厂商的官方价和我们的价并排公布 —— 下面的档位实时读取自网关 rate card,与实际计费一致。
开通方式
几种方式即可开始。
可在 Console 几秒完成在线充值。也可以用以下任一方式:
充值
以美元计价,按量付费。
余额永不过期。赠送阶梯由充值金额决定。
余额永不过期。赠送在充值时计入,不影响消耗。失败请求不计费 —— 可通过 x-bytespike-credits-estimated 响应头在请求执行前预览成本。
按端点计费
每个模型,官方价 vs 我们的价。
把每家厂商的官方价与我们的价并排、按品牌分组列出 —— 折扣实时来自网关发布的 rate card。调用失败不计费。
Anthropic
7| 模型 | 官方价 | 我们的价 | 折扣 |
|---|---|---|---|
| Claude Haiku 4.5 最快的 Claude,接近前沿智能;200k 上下文,支持扩展思考。 | $1 / $5 | $0.18 / $0.9每 1M tokens | 1.8折 |
| Claude Opus 4.6 上代旗舰,1M 上下文,支持扩展思考。建议迁移至 Opus 4.7。 | $5 / $25 | $0.9 / $4.5每 1M tokens | 1.8折 |
| Claude Opus 4.7 Anthropic 最强通用模型,擅长复杂推理与 agentic coding,原生 1M 上下文。 | $5 / $25 | $0.9 / $4.5每 1M tokens | 1.8折 |
| Claude Opus 4.8 Anthropic 最新旗舰,复杂推理与 agentic coding 进一步增强,原生 1M 上下文。 | $5 / $25 | $0.9 / $4.5每 1M tokens | 1.8折 |
| Claude Opus 5 Anthropic 最新旗舰 Claude Opus 5,复杂推理与 agentic coding 全面领先,原生 1M 上下文。 | $5 / $25 | $0.9 / $4.5每 1M tokens | 1.8折 |
| Claude Sonnet 4.6 速度与智能的最佳平衡;1M 上下文,支持扩展/自适应思考。 | $3 / $15 | $0.54 / $2.7每 1M tokens | 1.8折 |
| Claude Sonnet 5 速度与智能的最佳平衡,adaptive thinking 默认开启,原生 1M 上下文。 | $2 / $10 | $0.36 / $1.8每 1M tokens | 1.8折 |
OpenAI
8| 模型 | 官方价 | 我们的价 | 折扣 |
|---|---|---|---|
| GPT-5.4 OpenAI 更经济的编码与专业工作模型,1M 上下文。 | $2.5 / $15 | $2 / $12每 1M tokens | 8折 |
| GPT-5.4 mini OpenAI 最强 mini 模型,适合 coding、computer use、subagents,400k 上下文。 | $0.75 / $4.5 | $0.6 / $3.6每 1M tokens | 8折 |
| GPT-5.5 OpenAI 旗舰编码与专业工作模型,reasoning effort 可调,1M 上下文。 | $5 / $30 | $4 / $24每 1M tokens | 8折 |
| GPT-5.6 (Sol) GPT-5.6 官方别名,固定路由到旗舰档 Sol。 | $4 / $20 | $3.2 / $16每 1M tokens | 8折 |
| GPT-5.6 Luna OpenAI 成本敏感高吞吐档(月档),适合抽取/分类/总结类任务,1.05M 上下文。 | $0.2 / $1.2 | $0.16 / $0.96每 1M tokens | 8折 |
| GPT-5.6 Sol OpenAI 旗舰前沿模型(日档),复杂编码与长程 agentic 任务,reasoning effort 支持到 max,1.05M 上下文。 | $5 / $30 | $4 / $24每 1M tokens | 8折 |
| GPT-5.6 Terra OpenAI 智能与成本均衡档(地档),官方称性能与 GPT-5.5 相当但更便宜,1.05M 上下文。 | $2 / $12 | $1.6 / $9.6每 1M tokens | 8折 |
| GPT Image 2 OpenAI 原生图像生成与编辑(/v1/images generations + edits),支持任意分辨率。 | $5 / $10 | $4 / $8每 1M tokens | 8折 |
| 模型 | 官方价 | 我们的价 | 折扣 |
|---|---|---|---|
| Gemini 3.1 Flash-Lite 低延迟、成本经济的多模态模型,适合翻译、转录、文档处理等高频轻量任务。 | $0.25 / $1.5 | $0.25 / $1.5每 1M tokens | 原价 |
| Gemini 3.5 Flash Google 最智能模型,持续前沿性能,擅长 agentic 与代码任务。 | $1.5 / $9 | $1.5 / $9每 1M tokens | 原价 |
| Gemini Flash (latest) 永远指向最新一代 Gemini Flash;当前等同 gemini-3.5-flash。 | $0.3 / $2.5 | $0.3 / $2.5每 1M tokens | 原价 |
| Gemini Flash-Lite (latest) 永远指向最新一代 Gemini Flash-Lite;当前等同 gemini-3.1-flash-lite。 | $0.25 / $1.5 | $0.25 / $1.5每 1M tokens | 原价 |
| Gemini Pro (latest) Google 旗舰 thinking 模型,擅长复杂代码、数学、STEM 推理;1M 上下文。 | $2 / $12 | $2 / $12每 1M tokens | 原价 |
DeepSeek
2| 模型 | 官方价 | 我们的价 | 折扣 |
|---|---|---|---|
| DeepSeek V4 Flash DeepSeek 更快捷、经济的 API 服务;官方通道已切到视觉 SKU,支持图片理解;默认开启深度思考,支持手动关闭。 | $0.44 / $1.32 | $0.44 / $1.32每 1M tokens | 原价 |
| DeepSeek V4 Pro DeepSeek V4 Pro,Agent 能力显著增强,具备丰富世界知识;默认开启深度思考,支持手动关闭。 | $1.32 / $3.96 | $1.32 / $3.96每 1M tokens | 原价 |
智谱 GLM
1| 模型 | 官方价 | 我们的价 | 折扣 |
|---|---|---|---|
| GLM 5.3 Flash 智谱 GLM-5 系列首个原生多模态模型,320B 总参/18B 激活,支持图片/视频/文件输入与 1M 上下文。 | $0.15 / $0.5 | $0.15 / $0.5每 1M tokens | 原价 |
月之暗面 Kimi
1| 模型 | 官方价 | 我们的价 | 折扣 |
|---|---|---|---|
| Kimi K3 Kimi 旗舰多模态模型(文本/图片/视频输入),1M 上下文,常驻推理并可经 reasoning_effort 调节力度;Kimi Code 默认 high。 | $3 / $15 | $3 / $15每 1M tokens | 原价 |
Token 价格按 1M 计(输入 / 输出)。官方价为各厂商公开报价,我们的价在此基础上按品牌折扣计算。图像按 token 计费,视频按次计费。调用失败不计费 —— 最终扣费与提交时返回的 estimated_credits 一致。
费率卡更新于 · 2026-08-29
完整模型 rate card
26 个模型,价格透明,实时刷新。
每个 chat 模型都公开「官方价 vs 我们的价」(按 1M tokens);图像 / 视频按次计价。数据来自生产网关,每日刷新一次。没有隐藏阶梯,没有水分段落。
Chat 模型
25
图像模型
1
一把 key 一个 URL
llm.bytespike.ai/v1
所有价格以美元(USD)报价。ByteSpike 按量付费:充值美元余额,按 rate card 消耗 —— 无套餐、无最低消费、无自动续期。开通方式:在 console.bytespike.ai/billing 在线充值,或使用兑换码(console.bytespike.ai/billing#redeem)。余额永不过期,失败请求不计费。所列价格不含适用税费与 VAT,激活时根据账单地区计算。