Claude API 费用计算器

Anthropic 按 Token 对 Claude 计费,输入、输出和提示缓存各有单价。缓存需要主动开启:用 cache_control 标记共享前缀,写入缓存比普通输入贵,5 分钟缓存为输入价的 1.25×,1 小时缓存为 2×。之后复用该前缀的请求按输入价的 2.5%–10% 读取(因模型而异),每次读取都会重新计算缓存有效期。

折扣可以叠加。Batch API 输入减 50%、输出减 50%,Batch 中的缓存读取为常规缓存读取价的 50%,因此共享前缀的批量任务是使用 Claude 最便宜的方式。长提示则相反:长上下文费率适用于 Claude Haiku 5.5 超过 100K 时(输入 5×,输出 5×); Claude Sonnet 4.5 超过 200K 时(输入 2×,输出 1.5×),且作用于整个请求。阈值计算全部输入 Token,包括缓存读取和写入的部分,所以缓存大文档并不能让请求低于阈值。

下表按同一工作负载计算各模型费用:每天 10,000 次请求,每次输入 6,000 Token、输出 500 Token。三列依次为:不使用缓存;70% 的输入从缓存读取、5% 写入缓存;全部请求走 Batch API。同样的流量下,Claude Fable 5.1 的费用是 Claude Haiku 5.5 的 100 倍。

模型标准
每天 10,000 次 · 输入 6,000 · 输出 500
用你的数据计算 →
使用提示缓存
每天 10,000 次 · 输入 6,000 · 输出 500 · 缓存 70%
用你的数据计算 →
Batch API
每天 10,000 次 · 输入 6,000 · 输出 500 · batch
用你的数据计算 →
Claude Sonnet 5.5$5,100/月$2,751/月$2,550/月
Claude Opus 5.5$10,200/月$5,502/月$5,100/月
Claude Fable 5.1$25,500/月$13,440/月$12,750/月
Claude Haiku 5.5$255/月$144/月$128/月
Claude Haiku 4.5$2,550/月$1,438/月$1,275/月

基于公开的 Token 单价估算;做预算前请核对官方价格。 数据于 2026-10-08 从 LiteLLM 价格表同步.

你的流量下缓存何时划算?试试提示缓存计算器 →

常见问题

1 小时缓存值得用吗?

只有当同一前缀的复用间隔超过 5 分钟但在 1 小时以内时才划算,例如流量稀疏的客服机器人。1 小时缓存写入比 5 分钟写入更贵,流量稳定时,每次命中都会刷新的 5 分钟缓存更便宜。提示缓存计算器可按你的流量比较两者。

Claude 能同时使用 Batch API 和提示缓存吗?

可以。Batch 请求也能读写缓存,且 Batch 内的缓存价格同样打折。由于 Batch 请求的执行顺序不固定,命中情况较难预测,所以请把共享前缀的请求放在同一个 Batch 里。

为什么长提示会让 Claude 账单猛涨?

部分 Claude 模型在单个请求的输入超过阈值后改用长上下文费率,整个请求(包括缓存 Token)都按更高的输入和输出价格计费。可以用检索让提示保持在阈值以下,或选择没有长上下文档位的模型。