OpenAI API 费用计算器

OpenAI 会自动缓存重复的提示前缀:请求里无需任何标记,下列模型的缓存命中按输入价的 5%–10% 计费。在我们的数据中,GPT-5.4 mini, GPT-5.4 nano 没有缓存写入费,未命中与普通输入同价;GPT-6.1 Sol, GPT-6 Astra, GPT-6 Luna 则列有缓存写入价,为输入单价的 1.25×。GPT-5.5 Pro 完全没有缓存输入价,缓存对它不省钱。

Batch API 以异步返回结果为代价,输入减 50%、输出减 50%,Batch 中的缓存 Token 为常规缓存价的 50%。长上下文费率适用于 GPT-6.1 Sol, GPT-6 Astra, GPT-5.5 Pro, GPT-6 Luna 等另外 7 个模型 超过 272K 时(输入 2×,输出 1.5×),且作用于整个请求。影响最大的是模型档位:pro 模型每次回答投入更多算力,Token 单价高得多;mini 和 nano 以质量换价格;旗舰模型居中。

下表按同一工作负载计算各模型费用:每天 10,000 次请求,每次输入 6,000 Token、输出 500 Token。三列依次为:不使用缓存;70% 的输入从缓存读取、5% 写入缓存;全部请求走 Batch API。同样的流量下,GPT-5.5 Pro 的费用是 GPT-6 Luna 的 318 倍。

模型标准
每天 10,000 次 · 输入 6,000 · 输出 500
用你的数据计算 →
使用提示缓存
每天 10,000 次 · 输入 6,000 · 输出 500 · 缓存 70%
用你的数据计算 →
Batch API
每天 10,000 次 · 输入 6,000 · 输出 500 · batch
用你的数据计算 →
GPT-6.1 Sol$5,100/月$2,751/月$2,550/月
GPT-6 Astra$25,500/月$14,385/月$12,750/月
GPT-5.5 Pro$81,000/月$81,000/月
不支持缓存
$40,500/月
GPT-6 Luna$255/月$144/月$128/月
GPT-5.4 mini$2,025/月$1,174/月$1,012/月
GPT-5.4 nano$548/月$321/月$274/月

基于公开的 Token 单价估算;做预算前请核对官方价格。 数据于 2026-10-08 从 LiteLLM 价格表同步.

你的流量下缓存何时划算?试试提示缓存计算器 →

常见问题

使用 OpenAI 提示缓存需要改代码吗?

不需要。提示达到一定长度后会自动缓存。把固定内容(指令、工具定义、示例)放在开头,可变部分放在末尾,让各请求的前缀保持一致。

什么时候值得用 pro 模型?

当答错的代价高于额外 Token 费用时:复杂推理、高风险审核、调用量小的场景。在我们的数据中 pro 模型没有缓存输入价,高调用量应用每次请求都要支付全额输入价。

该用 mini 还是 nano?

nano 适合超大量的分类、抽取和路由;mini 能处理对话和简单推理。请用你自己的提示测试两者:便宜的模型如果需要重试或更长的提示,最终可能更贵。