渠道与价格
我们提供 10 个独立渠道,每个渠道明码标价。你创建 API Key 时绑一个渠道,调用时按该渠道的倍率扣费(Grok 渠道为按次计费,见下方说明)。
渠道列表
| 渠道 | 计费倍率 | 适合 |
|---|---|---|
| Claude 官方(仅限claude code) | 1.2x | Claude Code CLI 专用,高质量上游、稳定性最优;非 CC 客户端会被 503 拒 |
| Claude 官方(不限客户端) | 1.5x | Cline / Cursor 调 Claude / opencode / Open WebUI / Cherry Studio / 自建 SDK 调 Anthropic,不限客户端 |
| Claude 官方(可蒸馏) 🆕 | 1.5x | 同上,且允许把输出用于模型蒸馏 / 训练数据生成 —— 有此需求请选本渠道 |
| Claude AWS Bedrock 🆕 | 3.0x | AWS Bedrock 上游,高稳定高可用;Claude 全模型,适合对稳定性要求最高的生产工作流 |
| 低价claude | 0.5x | 任意客户端、价格最低;低价区,质量 / 稳定性相对不稳定 |
| Claude sonnet 折扣 | 0.5x ⭐ | 主用 Sonnet 写代码 / 分析 — 仅 Sonnet 系列 |
| Codex | 0.35x | OpenAI / Codex CLI / Cursor / Cline / Chatbox(同时支持 Responses + ChatCompletions 协议) |
| Codex 超低价 🆕 | 0.15x | OpenAI / GPT-5.x / GPT-5.6 系全模型,价位最低 |
| Gemini | 0.5x | 长文本、图像理解(Gemini 3 / 2.5,原生协议) |
| Grok(按次计费) 🆕 | 按次 | xAI Grok 系列(grok-3 / grok-4.3 / grok-4.5 等多档),按次计费不按 token;仅支持 /v1/chat/completions 端点 |
Grok 渠道按「次」计费(不按 token)
Grok 渠道每成功调用一次按固定单价扣费,与输入/输出 token 数无关:
| 模型 | 单价(每次调用) | 说明 |
|---|---|---|
| grok-3 | $0.014 / 次 | 通用对话(轻量) |
| grok-420-fast | $0.044 / 次 | 更强、更快 |
| grok-420-fast-deepsearch | $0.044 / 次 | 联网深度研究(响应较慢,几十秒级) |
| grok-4.3 | $0.06 / 次 | 4.3 代通用 |
| grok-4.3-fast | $0.06 / 次 | 4.3 代快速 |
| grok-4.5-latest | $0.08 / 次 | 4.5 代(latest) |
| grok-4.5 | $0.18 / 次 | 4.5 代旗舰(最强) |
- 只支持 OpenAI 兼容的
/v1/chat/completions端点(不支持/v1/responses)。用 Cline / Cursor / Chatbox / Cherry Studio / 自建 OpenAI SDK 时,把 base url 指向我们、model 填grok-3等即可。 - 因为按次计费,一次调用 = 一次扣费,不论这次对话多长。适合短问答、需要联网搜索的场景。
倍率怎么算
官方价 × 渠道倍率 = 你的实际价格。例如 Claude Sonnet 4.6 输入官方 $3/M tokens:
- Claude 官方(仅限claude code)1.2x → $3.6/M
- Claude 官方(不限客户端)1.5x → $4.5/M
- Claude 官方(可蒸馏)1.5x → $4.5/M
- 低价claude 0.5x → $1.5/M
- Claude sonnet 折扣 0.5x → $1.5/M
叠加充值倍率 ¥1=$1,等于人民币 ¥1.5/M。
五个 Claude 全模型渠道怎么选
模型 / 上下文长度都一样 —— 区别是客户端兼容性 + 上游质量 + 倍率 + 是否允许蒸馏:
Claude 官方(仅限claude code)1.2x:高质量上游,稳定性最优。但通道只接受官方 Claude Code CLI(claude-cli/X.Y.ZUA + 标准 metadata)。Cline / Cursor / opencode / Open WebUI / 自建 SDK 等会被返 503。Claude 官方(不限客户端)1.5x:任何 Anthropic 协议的客户端都能用,稳定性良好。Claude 官方(可蒸馏)1.5x 🆕:与「不限客户端」同价同模型,区别只有一条 —— 允许把模型输出用于蒸馏 / 训练数据生成。Claude AWS Bedrock3.0x:AWS Bedrock 上游,对稳定性 / 高可用要求最严苛的工作流(生产 agent、长时间批量任务、不能容忍单次失败)。价位高,但 SLA 体感最好。低价claude0.5x`:任意客户端、价格最低,但质量 / 稳定性相对不稳定 —— 适合对偶发失败容忍度高、追求性价比的场景。
只用 Claude Code CLI → 1.2x。其他工具要稳定 → 1.5x。要拿输出做蒸馏 / 训练数据 → 可蒸馏 1.5x。生产关键工作流要最稳 → AWS Bedrock 3.0x。追求最低价能容忍偶发失败 → 0.5x 低价区。
蒸馏 / 训练数据用途,只允许走「可蒸馏」渠道
把模型输出用于训练、微调、蒸馏自有模型,或批量生成训练数据集,只能使用 Claude 官方(可蒸馏) 渠道。
其余 Claude 渠道(仅限claude code / 不限客户端 / AWS Bedrock / 低价claude / Claude sonnet 折扣)均不可用于蒸馏。
两个 Codex (OpenAI) 渠道怎么选
支持的模型一致(GPT-5.x / GPT-5.6 全三档 / Codex 系列) —— 区别只在倍率与线路:
Codex0.35x:稳定老渠道,纯文本调用 (Chat Completions + Responses)。Codex 超低价0.15x:新上游渠道,价位最低。
想稳定 → Codex 0.35x。想省钱 → Codex 超低价 0.15x。图像生成请用专门的生图渠道。
各渠道支持的模型
下面列的是请求里 model 字段必须填的精确字符串。短名兜底没做 —— 写 gpt-5 而不是 gpt-5.4 会拿到 503 No available accounts。
claude-opus-5 ← 旗舰(最新,仅「官方」三个渠道)
claude-opus-4-8 ← 上代旗舰
claude-opus-4-7
claude-sonnet-4-6 ← 主力(推荐)
claude-haiku-4-5-20251001 ← 便宜快
claude-opus-4-6 ← 上代
claude-opus-4-5-20251101 ← 上代
claude-sonnet-4-5-20250929 ← 上代
claude-fable-5 ← 新模型(仅「官方」三个渠道)
# claude-opus-5 / claude-fable-5 仅在 Claude 官方(仅限claude code)+ Claude 官方(不限客户端)
# + Claude 官方(可蒸馏)三个渠道开放,AWS Bedrock / 低价claude 暂不含。
# 「可蒸馏」渠道支持 8 个模型:opus-5 / opus-4-8 / opus-4-7 / opus-4-6 /
# sonnet-5 / sonnet-4-6 / fable-5 / haiku-4-5-20251001(不含 opus-4-5 / sonnet-4-5 两个上代名)。
# 其余模型各渠道一致,区别在客户端兼容性 + 上游质量 + 倍率(1.2x / 1.5x / 1.5x / 3.0x / 0.5x)claude-sonnet-4-6 ← 主力(推荐)
claude-sonnet-4-5-20250929 ← 上代
# ⚠️ 仅支持 Sonnet 系列。调 opus / haiku 会拿到 503
# "channel pricing restriction"gpt-5.6-sol ← 🆕 最新旗舰(最强推理)
gpt-5.6-terra ← 🆕 均衡日常(性价比)
gpt-5.6-luna ← 🆕 低价高速
gpt-5.5 ← 上一代
gpt-5.5-codex ← Codex 编码专项
gpt-5.4 ← 主力(推荐)
gpt-5.4-mini ← 便宜
gpt-5.3-codex ← 编码专项
gpt-5.3-codex-spark ← Pro 专属(推理研究预览)
gpt-5.2 / gpt-5.2-pro
# 仅以上列表内的模型可用,**未列出的模型一律返 503**
# 图像生成(gpt-image-*) 不在 Codex 渠道 — 请用生图专用渠道
# Pro 系列(gpt-5.5-pro / gpt-5.4-pro)是 Responses-API only,Codex 通道不可用gpt-5.6-sol / gpt-5.6-terra ← 🆕 GPT-5.6 旗舰/均衡(更省)
gpt-5.6-luna ← 🆕 低价高速(更省)
gpt-5.5 / gpt-5.5-codex
gpt-5.4 / gpt-5.4-mini
gpt-5.3-codex / gpt-5.3-codex-spark
gpt-5.2 / gpt-5.2-pro
# 价位最低 (0.15x);图像生成请用生图专用渠道gemini-3.1-pro-preview ← 旗舰(带 thinking)
gemini-3-pro-preview ← 主力
gemini-3-flash-preview ← 快速
gemini-2.5-pro ← 上代旗舰
gemini-2.5-flash ← 上代快速Gemini 渠道走原生协议
Gemini 用 Google 原生 /v1beta/models/{model}:generateContent(或 :streamGenerateContent?alt=sse)端点,不走 OpenAI / Anthropic 兼容。请求里每个 contents item 必须显式带 "role": "user",否则 Google 会返回 400 Request contains an invalid argument。详见 常见问题。
🎨 图像生成
图像生成由专门的生图渠道负责,不在 Codex 渠道。最简单的用法:登录后侧边栏「AI 图像生成」工具,选 Key + prompt 直接生成,支持参考图改图 + 多平台 (OpenAI / Gemini / Antigravity)。
⚡ 1M 长上下文(Beta)
3 个模型支持 1M token 上下文窗口(默认 200K):
| 模型 | 默认 | 1M 模式 |
|---|---|---|
claude-opus-4-7 | 200K | ✅ |
claude-opus-4-6 | 200K | ✅ |
claude-sonnet-4-6 | 200K | ✅ |
怎么开启
请求里加 header:
anthropic-beta: context-1m-2025-08-07如果同时启用了别的 beta(例如 thinking),逗号分隔即可:
anthropic-beta: context-1m-2025-08-07,interleaved-thinking-2025-05-14调用支持 1M 的模型时,header 会透传到 Anthropic,1M 模式生效。调用不支持 1M 的模型时(haiku / 老 opus / 老 sonnet)我们这边会自动 strip 这个 header,不会向上游发出异常请求 —— 你写错 model 也不会触发 Anthropic 端的风控。
成本提醒
1M context 单次请求的 token 消耗远高于 200K 模式。Anthropic 官方对 1M context 输入价 2x:
- 普通模式:Sonnet 4.6 输入 $3/M
- 1M 模式(>200K 部分):Sonnet 4.6 输入 $6/M
折算到我们:
- Claude 官方(仅限claude code)1.2x → 1M 模式 $7.2/M
- Claude 官方(不限客户端)/(可蒸馏)1.5x → 1M 模式 $9/M
- 低价claude 0.5x → 1M 模式 $3/M
- Claude sonnet 折扣 0.5x → $3/M
塞满 1M context 的单次调用成本可达 $3–10 量级,5h 内多次满载会快速消耗调度配额。建议:
- 仅在真需要时(大代码库分析、长文档摘要)开启
- 用完关闭
- 充值余额留 buffer
我应该选哪个渠道
graph LR
A[选择渠道] --> B{用什么工具?}
B -->|Claude Code CLI| C{Sonnet 还是 Opus?}
C -->|Sonnet| D[Claude sonnet 折扣]
C -->|Opus / Haiku| E[Claude 官方<br/>仅限claude code 1.2x]
B -->|Cline / Cursor 调 Claude / opencode / 调 Anthropic SDK| Q{要稳定还是要便宜?}
Q -->|要稳定| F[Claude 官方<br/>不限客户端 1.5x]
Q -->|输出要用于蒸馏/训练| R[Claude 官方<br/>可蒸馏 1.5x]
Q -->|生产关键 要最稳| K[Claude AWS Bedrock 3.0x]
Q -->|要最低价| L[低价claude 0.5x<br/>质量不稳定]
B -->|Codex CLI / Cursor / OpenAI 兼容| G{要稳定还是要省钱?}
G -->|想省钱| M[Codex 超低价 0.15x]
G -->|要稳| N[Codex 0.35x]
B -->|要多模态/长文档| H[Gemini]
B -->|多渠道混用| I[创建多个 Key,<br/>各绑一个渠道]简化推荐
- Claude Code CLI 主用 Sonnet → Claude sonnet 折扣(最便宜,仅 Sonnet)
- Claude Code CLI 用 Opus / Haiku → Claude 官方(仅限claude code) 1.2x(高质量上游)
- Cline / Cursor 调 Claude / opencode / Open WebUI 走 Anthropic 协议,要稳定 → Claude 官方(不限客户端) 1.5x
- 要把输出用于蒸馏 / 训练数据生成 → Claude 官方(可蒸馏) 1.5x(同价,唯一允许此用途的渠道)
- 生产关键工作流要最稳 → Claude AWS Bedrock 3.0x
- 任意客户端、追求最低价、能容忍偶发失败 → 低价claude 0.5x
- Codex CLI / Cursor 调 GPT 纯文本 → Codex 0.35x
- 想最省钱 → Codex 超低价 0.15x
- 不确定 → Codex 超低价(兼容性最好,几乎所有支持"OpenAI API"的工具都能用 + 最低价)
充值倍率
¥1 = $1(充值倍率 1.0x)。例如:
- 充 ¥100 → 钱包余额 $100
- 调一次 Claude Sonnet 4.6 完整对话约 $0.018(含输入 1k + 输出 500 tokens,0.5x 折扣组)
- 算下来 ¥100 大约能撑 5500 次中等长度对话
详见 充值与套餐。
服务限流说明
为保证服务长期稳定,我们的调度系统会自动控制单位时间内的调用量。短时间内请求过密时,部分请求会暂时返回 429,1–5 分钟内自动恢复。
如果你的工作流对偶发 429 敏感,建议:
- 在客户端实现简单的指数退避重试
- 错峰使用(避开 19:00–23:00 高峰)
- 重要任务用多 Key 轮换
详见 常见问题。
