计价举例:Claude Opus 4.7
本文以 Claude Opus 4.7 为例,说清控制台的计价公式,并演示输入、输出、缓存写入、缓存读取四种维度的详细计算。
一、核心公式(最重要,先记住这个)
老版控制台的计价逻辑只有一条公式:
平台积分扣费 = 美元标准单价 × 实际 Token 数 × 倍率三个变量:
- 美元标准单价:模型供应商公布的官方价格(美元/Token),每个模型固定,输入和输出分开定价
- 实际 Token 数:本次调用实际消耗的 Token 数量,由平台自动统计
- 倍率:分组的倍率系数,决定你最终付多少。倍率 1.0 = 按美元原价 1:1 折算积分;倍率 0.6 = 打六折;倍率 2.0 = 两倍价
最终你扣的积分 = 美元价 × Token × 倍率。倍率是唯一的价格杠杆——同一个模型,选不同分组(倍率不同),价格就不同。
二、Opus 4.7 的美元标准单价
以下是 Anthropic 官方公布的 Claude Opus 4.7 定价(美元 / 百万 Token):
| 计费维度 | 美元标准单价($/百万 Token) | 说明 |
|---|---|---|
| 输入 | $5 | 你发给模型的内容 |
| 输出 | $25 | 模型回复的内容 |
| 缓存写入(5 分钟有效期) | $6.25 | 首次缓存内容,5 分钟内有效 |
| 缓存写入(1 小时有效期) | $10 | 首次缓存内容,1 小时内有效 |
| 缓存读取 | $0.5 | 命中已缓存的内容,仅为普通输入价的十分之一 |
三、套公式算一遍
场景:用 Opus 4.7 做代码审查,倍率 1.0
- 每次调用带一份固定的项目规范文档作为系统提示(10,000 Token)
- 每次发送一段待审查的代码(2,000 Token)
- 模型返回审查意见(3,000 Token)
- 连续审查 5 段代码
第 1 次调用:缓存未命中,写入缓存
项目规范首次出现,写入缓存(按 5 分钟有效期)。
缓存写入 = $6.25 / 1M × 10,000 × 倍率 1.0 = 0.0625 积分
普通输入 = $5 / 1M × 2,000 × 倍率 1.0 = 0.01 积分
输出 = $25 / 1M × 3,000 × 倍率 1.0 = 0.075 积分
第 1 次 = 0.0625 + 0.01 + 0.075 = 0.1475 积分 ≈ 1 毛 5第 2~5 次调用:缓存命中
规范已缓存,这 10,000 Token 按缓存读取价计费。
缓存读取 = $0.5 / 1M × 10,000 × 倍率 1.0 = 0.005 积分
普通输入 = $5 / 1M × 2,000 × 倍率 1.0 = 0.01 积分
输出 = $25 / 1M × 3,000 × 倍率 1.0 = 0.075 积分
每次 = 0.005 + 0.01 + 0.075 = 0.09 积分 ≈ 9 分钱总账(倍率 1.0)
第 1 次:0.1475 积分
第 2~5 次:0.09 × 4 = 0.36 积分
5 次合计 = 0.5075 积分 ≈ 5 毛钱换个倍率再算一遍(官方尊享分组,倍率 4.0)
同样的用量,选官方尊享分组(倍率 4.0,直连官方通道,最高稳定性):
第 1 次 = 0.1475 × 4.0 = 0.59 积分
每次后续 = 0.09 × 4.0 = 0.36 积分
5 次合计 = 0.59 + 0.36 × 4 = 2.03 积分 ≈ 2 块钱倍率从 1.0 到 4.0,费用变为 4 倍(0.5075 → 2.03)——你多付的钱买的是官方直连通道的稳定性和速度保障。
对比:不用缓存(倍率 1.0)
每次 = $5 / 1M × 12,000 × 1.0 + $25 / 1M × 3,000 × 1.0
= 0.06 + 0.075 = 0.135 积分
5 次 = 0.675 积分 ≈ 近 7 毛钱用缓存(0.5075)比不用(0.675)省了约 25%。
四、四种计费维度速查
| 维度 | 什么时候产生 | 与输入价的关系 |
|---|---|---|
| 普通输入 | 你发给模型的新内容 | 基准(1x) |
| 输出 | 模型回复的内容 | 通常 5x 输入价 |
| 缓存写入(5 分钟) | 首次缓存一段内容 | 1.25x 输入价 |
| 缓存写入(1 小时) | 首次缓存,更长有效期 | 2x 输入价 |
| 缓存读取 | 命中已缓存的内容 | 0.1x 输入价(十分之一) |
每一维度最终都套同一个公式:美元标准单价 × Token × 倍率 = 积分扣费。
五、怎么在使用记录里看扣费明细
在控制台「使用记录」页,点击某条调用记录的费用数字旁的信息图标,会弹出成本明细弹窗,里面完整展示了本次调用的计费过程:
成本明细
──────────────────────
输入成本 $x.xxxxxx
输出成本 $x.xxxxxx
缓存创建成本 $x.xxxxxx
缓存读取成本 $x.xxxxxx
倍率 2.00x
原始 $x.xxxxxx ← 上面四项美元成本的总和
计费 x.xxxxxx ← 最终扣的积分
──────────────────────对照公式验证:
- 四项美元成本:系统按美元标准单价 × 实际 Token 数,分别算出输入、输出、缓存创建、缓存读取的美元消费
- 原始:四项美元成本求和,就是本次调用的美元总消费
- 倍率:你这把 Key 绑定的分组倍率
- 计费(积分):原始 × 倍率 = 最终扣你的积分数
举个真实例子:
输入成本 $0.000010
输出成本 $0.004525
缓存创建成本 $0.006119
缓存读取成本 $0.102940
原始 = $0.000010 + $0.004525 + $0.006119 + $0.102940 = $0.113594
倍率 = 2.00x
计费 = $0.113594 × 2.0 = 0.227187 积分所以这条记录最终扣了 0.227187 积分(约 2 毛 3 分钱)。
如果弹窗里某项成本为 $0,说明本次调用没有产生该类型的消耗(比如没有命中缓存时,缓存读取成本就是 $0)。
六、常见问题
Q:倍率在哪看? A:创建 Key 时绑定分组,分组旁边会显示倍率。也可以在控制台「调用指南」或「可用渠道」页查看。
Q:缓存怎么触发?我需要手动操作吗? A:不需要。当请求中包含大段重复的系统提示或上下文时,模型自动缓存。你只需在使用记录里留意"缓存读取"字样即可确认生效。
Q:所有模型都支持缓存吗? A:不是。目前主要是 Claude 系列模型支持提示缓存。是否支持以模型广场标注为准。
Q:Opus 4.7 为什么比 Sonnet 贵? A:Opus 是旗舰档位,擅长复杂推理和长文本分析。如果场景不需要那么强的推理能力,可以选 Sonnet(输入 $3、输出 $15/百万 Token)或 Haiku(更便宜),在模型广场里对比各模型价格。
联系我们
- 电子邮箱:support_cloudrouter@clouditera.com
- QQ 社群:712273971
- 平台网址:cloudrouter.online