Gemini Flash Lite (latest) API 价格

Google 模型 · 上下文 1,048,576 Token · 最大输出 65,536 · 视觉, 推理。数据最近变更于 2026-10-08。 官方价格 ↗ · 数据于 2026-10-07 从 LiteLLM 价格表同步.

输入$0.30 / 1M Token
输出$2.50 / 1M Token
缓存输入$0.03 / 1M Token
Batch 输入$0.15 / 1M Token
Batch 输出$1.25 / 1M Token

计算我的费用 →

每月费用

场景(每月)Gemini Flash Lite (latest)
客服聊天机器人
每天 5,000 次 · 输入 1,200 · 输出 400 · 缓存 60%
$175
基于文档的 RAG
每天 2,000 次 · 输入 8,000 · 输出 600 · 缓存 30%
$195
编程 Agent
每天 1,500 次 · 输入 25,000 · 输出 2,000 · 缓存 80%
$320
深度推理
每天 800 次 · 输入 3,000 · 输出 6,000 · 缓存 20%
$378
Batch 批量处理
每天 50,000 次 · 输入 1,500 · 输出 150 · batch
$619

在计算器中调整数值。

更便宜的替代模型

推理模型中聊天机器人场景月度费用最低的:

对比

价格历史

自 2026-10-07 开始跟踪以来没有价格变动。