跳到主要内容
万川

计费说明

公开目录给出的是倍率,不是单价。这一页说明倍率怎么换算成钱,以及为什么输出通常比输入贵。

最终扣费以控制台用量与账单为准。本站展示的是最近一次同步的公开目录快照(2026-08-30),用于选型,不保证与瞬时配置零延迟一致。

预付费钱包

  • 先在控制台充值,再按实际调用扣减余额。没有月席位费。
  • 余额不足时计费调用返回 402,充值后即可恢复。
  • 支付渠道以控制台当前启用项为准,本站不列出未开通的渠道。
  • 充值入口: https://chuanapi.com/wallet

倍率如何变成单价

公开目录里每个按量模型给的是 model_ratio (倍率),换算成每 100 万 tokens 的单价需要除以控制台的 quota_per_unit。当前该值为 500000,计价单位为 USD

输入单价 = model_ratio × 1000000 ÷ quota_per_unit
输出单价 = 输入单价 × completion_ratio

单次成本 ≈ 输入单价 × (输入 tokens ÷ 1000000)
        + 输出单价 × (输出 tokens ÷ 1000000)

输出比输入贵

completion_ratio 是输出侧的倍数。它为 1 时输入输出同价;大于 1 时输出更贵。 下面是当前公开目录中按量模型的实算结果:

模型倍率输出系数输入 / 1M输出 / 1M
kimi-k2.7-code0.4754.2105263157894735$0.95$4
grok-4.30.6252$1.25$2.5
nvidia/neva-22b37.51$75$75
01-ai/yi-large37.51$75$75
nvidia/llama-3.1-nemotron-51b-instruct37.51$75$75

表中数字由上述公式从公开目录快照实时算出,随目录更新而变化。完整列表见 定价页

按次计费

部分模型(常见于图像生成)用 quota_type = 1,按调用次数计价而不是按 token。 这类模型直接展示固定单价,completion_ratio 不参与计算。

分组倍率

账号分组会带一个 group_ratio 作用在最终价格上。当前公开目录中的分组倍率为:

  • default:×1
  • svip:×1
  • vip:×1

分组同时决定可见模型范围。实际适用哪个分组以账号在控制台的设置为准。

估算一次调用的成本

先确认输入与输出的 token 量级,再套用上面的单价。要注意几项容易被漏掉的输入成本:

  • 多轮对话每次都会把完整历史作为输入重新计费,历史越长越贵。
  • 工具调用的结果会作为消息进入下一轮输入,见 工具调用
  • 图片按视觉 token 计入输入侧,分辨率越高越贵,见 视觉输入
  • 流式响应的增量通常不携带完整用量字段,不要依赖它记账。

核对账单

  1. 在模型详情页确认 model id 与计费展示。
  2. 对照 控制台定价页,它是账单口径的权威来源。
  3. 在控制台调用日志中按时间与 model id 定位具体请求,核对扣费。