Skip to content

渠道与价格

我们提供 10 个独立渠道,每个渠道明码标价。你创建 API Key 时绑一个渠道,调用时按该渠道的倍率扣费(Grok 渠道为按次计费,见下方说明)。

渠道列表

渠道计费倍率适合
Claude 官方(仅限claude code)1.2xClaude Code CLI 专用,高质量上游、稳定性最优;非 CC 客户端会被 503 拒
Claude 官方(不限客户端)1.5xCline / Cursor 调 Claude / opencode / Open WebUI / Cherry Studio / 自建 SDK 调 Anthropic,不限客户端
Claude 官方(可蒸馏) 🆕1.5x同上,且允许把输出用于模型蒸馏 / 训练数据生成 —— 有此需求请选本渠道
Claude AWS Bedrock 🆕3.0xAWS Bedrock 上游,高稳定高可用;Claude 全模型,适合对稳定性要求最高的生产工作流
低价claude0.5x任意客户端、价格最低;低价区,质量 / 稳定性相对不稳定
Claude sonnet 折扣0.5x主用 Sonnet 写代码 / 分析 — 仅 Sonnet 系列
Codex0.35xOpenAI / Codex CLI / Cursor / Cline / Chatbox(同时支持 Responses + ChatCompletions 协议)
Codex 超低价 🆕0.15xOpenAI / GPT-5.x / GPT-5.6 系全模型,价位最低
Gemini0.5x长文本、图像理解(Gemini 3 / 2.5,原生协议)
Grok(按次计费) 🆕按次xAI Grok 系列(grok-3 / grok-4.3 / grok-4.5 等多档),按次计费不按 token;仅支持 /v1/chat/completions 端点

Grok 渠道按「次」计费(不按 token)

Grok 渠道每成功调用一次按固定单价扣费,与输入/输出 token 数无关

模型单价(每次调用)说明
grok-3$0.014 / 次通用对话(轻量)
grok-420-fast$0.044 / 次更强、更快
grok-420-fast-deepsearch$0.044 / 次联网深度研究(响应较慢,几十秒级)
grok-4.3$0.06 / 次4.3 代通用
grok-4.3-fast$0.06 / 次4.3 代快速
grok-4.5-latest$0.08 / 次4.5 代(latest)
grok-4.5$0.18 / 次4.5 代旗舰(最强)
  • 只支持 OpenAI 兼容的 /v1/chat/completions 端点(不支持 /v1/responses)。用 Cline / Cursor / Chatbox / Cherry Studio / 自建 OpenAI SDK 时,把 base url 指向我们、model 填 grok-3 等即可。
  • 因为按次计费,一次调用 = 一次扣费,不论这次对话多长。适合短问答、需要联网搜索的场景。

倍率怎么算

官方价 × 渠道倍率 = 你的实际价格。例如 Claude Sonnet 4.6 输入官方 $3/M tokens:

  • Claude 官方(仅限claude code)1.2x → $3.6/M
  • Claude 官方(不限客户端)1.5x → $4.5/M
  • Claude 官方(可蒸馏)1.5x → $4.5/M
  • 低价claude 0.5x → $1.5/M
  • Claude sonnet 折扣 0.5x → $1.5/M

叠加充值倍率 ¥1=$1,等于人民币 ¥1.5/M。

五个 Claude 全模型渠道怎么选

模型 / 上下文长度都一样 —— 区别是客户端兼容性 + 上游质量 + 倍率 + 是否允许蒸馏:

  • Claude 官方(仅限claude code) 1.2x:高质量上游,稳定性最优。但通道只接受官方 Claude Code CLI(claude-cli/X.Y.Z UA + 标准 metadata)。Cline / Cursor / opencode / Open WebUI / 自建 SDK 等会被返 503。
  • Claude 官方(不限客户端) 1.5x:任何 Anthropic 协议的客户端都能用,稳定性良好。
  • Claude 官方(可蒸馏) 1.5x 🆕:与「不限客户端」同价同模型,区别只有一条 —— 允许把模型输出用于蒸馏 / 训练数据生成。
  • Claude AWS Bedrock 3.0x:AWS Bedrock 上游,对稳定性 / 高可用要求最严苛的工作流(生产 agent、长时间批量任务、不能容忍单次失败)。价位高,但 SLA 体感最好。
  • 低价claude 0.5x`:任意客户端、价格最低,但质量 / 稳定性相对不稳定 —— 适合对偶发失败容忍度高、追求性价比的场景。

只用 Claude Code CLI → 1.2x。其他工具要稳定 → 1.5x。要拿输出做蒸馏 / 训练数据 → 可蒸馏 1.5x。生产关键工作流要最稳 → AWS Bedrock 3.0x。追求最低价能容忍偶发失败 → 0.5x 低价区。

蒸馏 / 训练数据用途,只允许走「可蒸馏」渠道

把模型输出用于训练、微调、蒸馏自有模型,或批量生成训练数据集,只能使用 Claude 官方(可蒸馏) 渠道

其余 Claude 渠道(仅限claude code / 不限客户端 / AWS Bedrock / 低价claude / Claude sonnet 折扣均不可用于蒸馏

两个 Codex (OpenAI) 渠道怎么选

支持的模型一致(GPT-5.x / GPT-5.6 全三档 / Codex 系列) —— 区别只在倍率与线路:

  • Codex 0.35x:稳定老渠道,纯文本调用 (Chat Completions + Responses)。
  • Codex 超低价 0.15x:新上游渠道,价位最低。

想稳定 → Codex 0.35x。想省钱 → Codex 超低价 0.15x。图像生成请用专门的生图渠道。

各渠道支持的模型

下面列的是请求里 model 字段必须填的精确字符串。短名兜底没做 —— 写 gpt-5 而不是 gpt-5.4 会拿到 503 No available accounts

text
claude-opus-5                    ← 旗舰(最新,仅「官方」三个渠道)
claude-opus-4-8                  ← 上代旗舰
claude-opus-4-7
claude-sonnet-4-6                ← 主力(推荐)
claude-haiku-4-5-20251001        ← 便宜快
claude-opus-4-6                  ← 上代
claude-opus-4-5-20251101         ← 上代
claude-sonnet-4-5-20250929       ← 上代
claude-fable-5                   ← 新模型(仅「官方」三个渠道)

# claude-opus-5 / claude-fable-5 仅在 Claude 官方(仅限claude code)+ Claude 官方(不限客户端)
#   + Claude 官方(可蒸馏)三个渠道开放,AWS Bedrock / 低价claude 暂不含。
# 「可蒸馏」渠道支持 8 个模型:opus-5 / opus-4-8 / opus-4-7 / opus-4-6 /
#   sonnet-5 / sonnet-4-6 / fable-5 / haiku-4-5-20251001(不含 opus-4-5 / sonnet-4-5 两个上代名)。
# 其余模型各渠道一致,区别在客户端兼容性 + 上游质量 + 倍率(1.2x / 1.5x / 1.5x / 3.0x / 0.5x)
text
claude-sonnet-4-6                ← 主力(推荐)
claude-sonnet-4-5-20250929       ← 上代

# ⚠️ 仅支持 Sonnet 系列。调 opus / haiku 会拿到 503
#   "channel pricing restriction"
text
gpt-5.6-sol                      ← 🆕 最新旗舰(最强推理)
gpt-5.6-terra                    ← 🆕 均衡日常(性价比)
gpt-5.6-luna                     ← 🆕 低价高速
gpt-5.5                          ← 上一代
gpt-5.5-codex                    ← Codex 编码专项
gpt-5.4                          ← 主力(推荐)
gpt-5.4-mini                     ← 便宜
gpt-5.3-codex                    ← 编码专项
gpt-5.3-codex-spark              ← Pro 专属(推理研究预览)
gpt-5.2 / gpt-5.2-pro

# 仅以上列表内的模型可用,**未列出的模型一律返 503**
# 图像生成(gpt-image-*) 不在 Codex 渠道 — 请用生图专用渠道
# Pro 系列(gpt-5.5-pro / gpt-5.4-pro)是 Responses-API only,Codex 通道不可用
text
gpt-5.6-sol / gpt-5.6-terra      ← 🆕 GPT-5.6 旗舰/均衡(更省)
gpt-5.6-luna                     ← 🆕 低价高速(更省)
gpt-5.5 / gpt-5.5-codex
gpt-5.4 / gpt-5.4-mini
gpt-5.3-codex / gpt-5.3-codex-spark
gpt-5.2 / gpt-5.2-pro

# 价位最低 (0.15x);图像生成请用生图专用渠道
text
gemini-3.1-pro-preview           ← 旗舰(带 thinking)
gemini-3-pro-preview             ← 主力
gemini-3-flash-preview           ← 快速
gemini-2.5-pro                   ← 上代旗舰
gemini-2.5-flash                 ← 上代快速

Gemini 渠道走原生协议

Gemini 用 Google 原生 /v1beta/models/{model}:generateContent(或 :streamGenerateContent?alt=sse)端点,不走 OpenAI / Anthropic 兼容。请求里每个 contents item 必须显式带 "role": "user",否则 Google 会返回 400 Request contains an invalid argument。详见 常见问题

🎨 图像生成

图像生成由专门的生图渠道负责,不在 Codex 渠道。最简单的用法:登录后侧边栏「AI 图像生成」工具,选 Key + prompt 直接生成,支持参考图改图 + 多平台 (OpenAI / Gemini / Antigravity)。

⚡ 1M 长上下文(Beta)

3 个模型支持 1M token 上下文窗口(默认 200K):

模型默认1M 模式
claude-opus-4-7200K
claude-opus-4-6200K
claude-sonnet-4-6200K

怎么开启

请求里加 header:

http
anthropic-beta: context-1m-2025-08-07

如果同时启用了别的 beta(例如 thinking),逗号分隔即可:

http
anthropic-beta: context-1m-2025-08-07,interleaved-thinking-2025-05-14

调用支持 1M 的模型时,header 会透传到 Anthropic,1M 模式生效。调用不支持 1M 的模型时(haiku / 老 opus / 老 sonnet)我们这边会自动 strip 这个 header,不会向上游发出异常请求 —— 你写错 model 也不会触发 Anthropic 端的风控。

成本提醒

1M context 单次请求的 token 消耗远高于 200K 模式。Anthropic 官方对 1M context 输入价 2x

  • 普通模式:Sonnet 4.6 输入 $3/M
  • 1M 模式(>200K 部分):Sonnet 4.6 输入 $6/M

折算到我们:

  • Claude 官方(仅限claude code)1.2x → 1M 模式 $7.2/M
  • Claude 官方(不限客户端)/(可蒸馏)1.5x → 1M 模式 $9/M
  • 低价claude 0.5x → 1M 模式 $3/M
  • Claude sonnet 折扣 0.5x → $3/M

塞满 1M context 的单次调用成本可达 $3–10 量级,5h 内多次满载会快速消耗调度配额。建议:

  • 仅在真需要时(大代码库分析、长文档摘要)开启
  • 用完关闭
  • 充值余额留 buffer

我应该选哪个渠道

mermaid
graph LR
    A[选择渠道] --> B{用什么工具?}
    B -->|Claude Code CLI| C{Sonnet 还是 Opus?}
    C -->|Sonnet| D[Claude sonnet 折扣]
    C -->|Opus / Haiku| E[Claude 官方<br/>仅限claude code 1.2x]
    B -->|Cline / Cursor 调 Claude / opencode / 调 Anthropic SDK| Q{要稳定还是要便宜?}
    Q -->|要稳定| F[Claude 官方<br/>不限客户端 1.5x]
    Q -->|输出要用于蒸馏/训练| R[Claude 官方<br/>可蒸馏 1.5x]
    Q -->|生产关键 要最稳| K[Claude AWS Bedrock 3.0x]
    Q -->|要最低价| L[低价claude 0.5x<br/>质量不稳定]
    B -->|Codex CLI / Cursor / OpenAI 兼容| G{要稳定还是要省钱?}
    G -->|想省钱| M[Codex 超低价 0.15x]
    G -->|要稳| N[Codex 0.35x]
    B -->|要多模态/长文档| H[Gemini]
    B -->|多渠道混用| I[创建多个 Key,<br/>各绑一个渠道]

简化推荐

  • Claude Code CLI 主用 SonnetClaude sonnet 折扣(最便宜,仅 Sonnet)
  • Claude Code CLI 用 Opus / HaikuClaude 官方(仅限claude code) 1.2x(高质量上游)
  • Cline / Cursor 调 Claude / opencode / Open WebUI 走 Anthropic 协议,要稳定Claude 官方(不限客户端) 1.5x
  • 要把输出用于蒸馏 / 训练数据生成Claude 官方(可蒸馏) 1.5x(同价,唯一允许此用途的渠道)
  • 生产关键工作流要最稳Claude AWS Bedrock 3.0x
  • 任意客户端、追求最低价、能容忍偶发失败低价claude 0.5x
  • Codex CLI / Cursor 调 GPT 纯文本Codex 0.35x
  • 想最省钱Codex 超低价 0.15x
  • 不确定Codex 超低价(兼容性最好,几乎所有支持"OpenAI API"的工具都能用 + 最低价)

充值倍率

¥1 = $1(充值倍率 1.0x)。例如:

  • 充 ¥100 → 钱包余额 $100
  • 调一次 Claude Sonnet 4.6 完整对话约 $0.018(含输入 1k + 输出 500 tokens,0.5x 折扣组)
  • 算下来 ¥100 大约能撑 5500 次中等长度对话

详见 充值与套餐

服务限流说明

为保证服务长期稳定,我们的调度系统会自动控制单位时间内的调用量。短时间内请求过密时,部分请求会暂时返回 429,1–5 分钟内自动恢复。

如果你的工作流对偶发 429 敏感,建议:

  • 在客户端实现简单的指数退避重试
  • 错峰使用(避开 19:00–23:00 高峰)
  • 重要任务用多 Key 轮换

详见 常见问题

本站为 API 反向代理服务,与 Anthropic / OpenAI / Google 无关联。