Gemini 3.8 Flash API 价格
Google 模型 · 上下文 1,048,576 Token · 最大输出 65,536 · 视觉, 推理。数据最近变更于 2026-10-08。 官方价格 ↗ · 数据于 2026-10-07 从 LiteLLM 价格表同步.
| 输入 | $0.75 / 1M Token |
|---|---|
| 输出 | $3.75 / 1M Token |
| 缓存输入 | $0.075 / 1M Token |
| Batch 输入 | $0.375 / 1M Token |
| Batch 输出 | $1.875 / 1M Token |
| Batch 缓存输入 | $0.0375 / 1M Token |
| 最小可缓存提示 | 4,096 Token |
每月费用
| 场景(每月) | Gemini 3.8 Flash |
|---|---|
| 客服聊天机器人 每天 5,000 次 · 输入 1,200 · 输出 400 · 缓存 60% | $360 |
| 基于文档的 RAG 每天 2,000 次 · 输入 8,000 · 输出 600 · 缓存 30% | $398 |
| 编程 Agent 每天 1,500 次 · 输入 25,000 · 输出 2,000 · 缓存 80% | $574 |
| 深度推理 每天 800 次 · 输入 3,000 · 输出 6,000 · 缓存 20% | $594 |
| Batch 批量处理 每天 50,000 次 · 输入 1,500 · 输出 150 · batch | $1,266 |
在计算器中调整数值。
更便宜的替代模型
推理模型中聊天机器人场景月度费用最低的:
- GPT-5 nano — $28.14/月
- Gemini 2.5 Flash Lite — $32.28/月
- Claude Haiku 5.5 — $38.51/月
- GPT-6 Luna — $38.51/月
- Mistral Small (latest) — $48.42/月
对比
价格历史
自 2026-10-07 开始跟踪以来没有价格变动。