Gemini 3.5 Flash Lite API 价格
Google 模型 · 上下文 1,048,576 Token · 最大输出 65,536 · 视觉, 推理。数据最近变更于 2026-10-08。 官方价格 ↗ · 数据于 2026-10-07 从 LiteLLM 价格表同步.
| 输入 | $0.30 / 1M Token |
|---|---|
| 输出 | $2.50 / 1M Token |
| 缓存输入 | $0.03 / 1M Token |
| Batch 输入 | $0.15 / 1M Token |
| Batch 输出 | $1.25 / 1M Token |
| Batch 缓存输入 | $0.02 / 1M Token |
每月费用
| 场景(每月) | Gemini 3.5 Flash Lite |
|---|---|
| 客服聊天机器人 每天 5,000 次 · 输入 1,200 · 输出 400 · 缓存 60% | $175 |
| 基于文档的 RAG 每天 2,000 次 · 输入 8,000 · 输出 600 · 缓存 30% | $195 |
| 编程 Agent 每天 1,500 次 · 输入 25,000 · 输出 2,000 · 缓存 80% | $320 |
| 深度推理 每天 800 次 · 输入 3,000 · 输出 6,000 · 缓存 20% | $378 |
| Batch 批量处理 每天 50,000 次 · 输入 1,500 · 输出 150 · batch | $619 |
在计算器中调整数值。
更便宜的替代模型
推理模型中聊天机器人场景月度费用最低的:
- GPT-5 nano — $28.14/月
- Gemini 2.5 Flash Lite — $32.28/月
- Claude Haiku 5.5 — $38.51/月
- GPT-6 Luna — $38.51/月
- Mistral Small (latest) — $48.42/月
对比
价格历史
自 2026-10-07 开始跟踪以来没有价格变动。