计费说明
公开目录给出的是倍率,不是单价。这一页说明倍率怎么换算成钱,以及为什么输出通常比输入贵。
最终扣费以控制台用量与账单为准。本站展示的是最近一次同步的公开目录快照(2026-08-30),用于选型,不保证与瞬时配置零延迟一致。
预付费钱包
- 先在控制台充值,再按实际调用扣减余额。没有月席位费。
- 余额不足时计费调用返回 402,充值后即可恢复。
- 支付渠道以控制台当前启用项为准,本站不列出未开通的渠道。
- 充值入口: https://chuanapi.com/wallet
倍率如何变成单价
公开目录里每个按量模型给的是 model_ratio (倍率),换算成每 100 万 tokens 的单价需要除以控制台的 quota_per_unit。当前该值为 500000,计价单位为 USD。
输入单价 = model_ratio × 1000000 ÷ quota_per_unit
输出单价 = 输入单价 × completion_ratio
单次成本 ≈ 输入单价 × (输入 tokens ÷ 1000000)
+ 输出单价 × (输出 tokens ÷ 1000000)输出比输入贵
completion_ratio 是输出侧的倍数。它为 1 时输入输出同价;大于 1 时输出更贵。 下面是当前公开目录中按量模型的实算结果:
| 模型 | 倍率 | 输出系数 | 输入 / 1M | 输出 / 1M |
|---|---|---|---|---|
| kimi-k2.7-code | 0.475 | 4.2105263157894735 | $0.95 | $4 |
| grok-4.3 | 0.625 | 2 | $1.25 | $2.5 |
| nvidia/neva-22b | 37.5 | 1 | $75 | $75 |
| 01-ai/yi-large | 37.5 | 1 | $75 | $75 |
| nvidia/llama-3.1-nemotron-51b-instruct | 37.5 | 1 | $75 | $75 |
表中数字由上述公式从公开目录快照实时算出,随目录更新而变化。完整列表见 定价页。
按次计费
部分模型(常见于图像生成)用 quota_type = 1,按调用次数计价而不是按 token。 这类模型直接展示固定单价,completion_ratio 不参与计算。
分组倍率
账号分组会带一个 group_ratio 作用在最终价格上。当前公开目录中的分组倍率为:
default:×1svip:×1vip:×1
分组同时决定可见模型范围。实际适用哪个分组以账号在控制台的设置为准。
估算一次调用的成本
先确认输入与输出的 token 量级,再套用上面的单价。要注意几项容易被漏掉的输入成本:
核对账单
- 在模型详情页确认 model id 与计费展示。
- 对照 控制台定价页,它是账单口径的权威来源。
- 在控制台调用日志中按时间与 model id 定位具体请求,核对扣费。