OpenAI API 费用计算器
OpenAI 会自动缓存重复的提示前缀:请求里无需任何标记,下列模型的缓存命中按输入价的 5%–10% 计费。在我们的数据中,GPT-5.4 mini, GPT-5.4 nano 没有缓存写入费,未命中与普通输入同价;GPT-6.1 Sol, GPT-6 Astra, GPT-6 Luna 则列有缓存写入价,为输入单价的 1.25×。GPT-5.5 Pro 完全没有缓存输入价,缓存对它不省钱。
Batch API 以异步返回结果为代价,输入减 50%、输出减 50%,Batch 中的缓存 Token 为常规缓存价的 50%。长上下文费率适用于 GPT-6.1 Sol, GPT-6 Astra, GPT-5.5 Pro, GPT-6 Luna 等另外 7 个模型 超过 272K 时(输入 2×,输出 1.5×),且作用于整个请求。影响最大的是模型档位:pro 模型每次回答投入更多算力,Token 单价高得多;mini 和 nano 以质量换价格;旗舰模型居中。
下表按同一工作负载计算各模型费用:每天 10,000 次请求,每次输入 6,000 Token、输出 500 Token。三列依次为:不使用缓存;70% 的输入从缓存读取、5% 写入缓存;全部请求走 Batch API。同样的流量下,GPT-5.5 Pro 的费用是 GPT-6 Luna 的 318 倍。
| 模型 | 标准 每天 10,000 次 · 输入 6,000 · 输出 500 用你的数据计算 → | 使用提示缓存 每天 10,000 次 · 输入 6,000 · 输出 500 · 缓存 70% 用你的数据计算 → | Batch API 每天 10,000 次 · 输入 6,000 · 输出 500 · batch 用你的数据计算 → |
|---|---|---|---|
| GPT-6.1 Sol | $5,100/月 | $2,751/月 | $2,550/月 |
| GPT-6 Astra | $25,500/月 | $14,385/月 | $12,750/月 |
| GPT-5.5 Pro | $81,000/月 | $81,000/月 不支持缓存 | $40,500/月 |
| GPT-6 Luna | $255/月 | $144/月 | $128/月 |
| GPT-5.4 mini | $2,025/月 | $1,174/月 | $1,012/月 |
| GPT-5.4 nano | $548/月 | $321/月 | $274/月 |
基于公开的 Token 单价估算;做预算前请核对官方价格。 数据于 2026-10-08 从 LiteLLM 价格表同步.
常见问题
使用 OpenAI 提示缓存需要改代码吗?
不需要。提示达到一定长度后会自动缓存。把固定内容(指令、工具定义、示例)放在开头,可变部分放在末尾,让各请求的前缀保持一致。
什么时候值得用 pro 模型?
当答错的代价高于额外 Token 费用时:复杂推理、高风险审核、调用量小的场景。在我们的数据中 pro 模型没有缓存输入价,高调用量应用每次请求都要支付全额输入价。
该用 mini 还是 nano?
nano 适合超大量的分类、抽取和路由;mini 能处理对话和简单推理。请用你自己的提示测试两者:便宜的模型如果需要重试或更长的提示,最终可能更贵。