Batch API pricing & savings

Batch APIs run requests asynchronously (results usually within 24 hours) in exchange for a lower price. Good fits: evaluations, classification, summarizing archives, embeddings backfills. Bad fits: anything a user is waiting on.

Estimate your monthly bill with this discount →

ModelNormal input /1MBatch input /1MSaving
Claude Fable 5$10.00$5.0050%
Claude Fable 5.1$10.00$5.0050%
Claude Haiku 4.5$1.00$0.5050%
Claude Mythos 5$10.00$5.0050%
Claude Mythos 5.1$10.00$5.0050%
Claude Opus 4.5$5.00$2.5050%
Claude Opus 4.6$5.00$2.5050%
Claude Opus 4.7$5.00$2.5050%
Claude Opus 4.8$5.00$2.5050%
Claude Opus 5$5.00$2.5050%
Claude Opus 5.5$4.00$2.0050%
Claude Sonnet 4.5$3.00$1.5050%
Claude Sonnet 4.6$3.00$1.5050%
Claude Sonnet 5$2.00$1.0050%
Claude Sonnet 5.5$2.00$1.0050%
Gemini 2.5 Flash$0.30$0.1550%
Gemini 2.5 Flash Lite$0.10$0.0550%
Gemini 2.5 Pro$1.25$0.62550%
Gemini 3 Flash Preview$0.50$0.2550%
Gemini 3.1 Flash Lite$0.25$0.12550%
Gemini 3.1 Pro Preview$2.00$1.0050%
Gemini 3.5 Flash$1.50$0.7550%
Gemini 3.5 Flash Lite$0.30$0.1550%
Gemini 3.6 Flash$0.75$0.37550%
Gemini 3.7 Flash$0.75$0.37550%
Gemini 3.8 Flash$0.75$0.37550%
Gemini Flash (latest)$0.75$0.37550%
Gemini Flash Lite (latest)$0.30$0.1550%
Gemini Pro (latest)$2.00$1.0050%
GPT-4.1$2.00$1.0050%
GPT-4.1 mini$0.40$0.2050%
GPT-4o$2.50$1.2550%
GPT-4o mini$0.15$0.07550%
GPT-5$1.25$0.62550%
GPT-5 mini$0.25$0.12550%
GPT-5 nano$0.05$0.02550%
GPT-5.1$1.25$0.62550%
GPT-5.2$1.75$0.87550%
GPT-5.4$2.50$1.2550%
GPT-5.4 mini$0.75$0.37550%
GPT-5.4 nano$0.20$0.1050%
GPT-5.5$5.00$2.5050%
GPT-5.6 Luna$0.20$0.1050%
GPT-5.6 Sol$4.00$2.0050%
GPT-5.6 Terra$2.00$1.0050%
GPT-6 Astra$10.00$5.0050%
GPT-6 Luna$0.10$0.0550%
GPT-6 Sol$2.00$1.0050%
GPT-6.1 Sol$2.00$1.0050%
o3$2.00$1.0050%
Grok 4.20 Non Reasoning$1.25$1.0020%
Grok 4.20 Reasoning$1.25$1.0020%
Grok 4.3$1.25$1.0020%

FAQ

Is batch output also discounted?

Usually yes, by the same share as input. Each model page lists both batch input and batch output prices.

Can I combine batch with prompt caching?

Some providers allow it and bill cached tokens at a reduced rate inside batches; check the provider's documentation for current rules.

Which providers have no batch price here?

Models without a published batch price in our data are left out of this table.