Gemini 3.5 Flash Lite API 价格

Google · 发布于 2026年7月21日 · 1.05M 上下文 · API 模型 ID gemini-3.5-flash-lite

Google 的 Gemini 3.5 Flash Lite API 价格:每百万输入 token $0.30,每百万输出 token $2.50(已对照官方价格页核实,2026年10月9日)。

价格

Gemini 3.5 Flash Lite 价格,美元 / 每百万 token
价格项美元 / 每百万 token
输入$0.30
输出$2.50
缓存读取$0.03
缓存写入未公布
批量输入$0.15
批量输出$1.25

已于 2026年10月9日 对照厂商官方价格页核实。 官方价格页

每月费用估算

$465.00

每月

每天
$15.50
每次请求
$0.00155

费用 = 输入 token × 输入价 + 输出 token × 输出价,每月按 30 天算。命中缓存的输入按缓存读取价计,不含缓存写入费。

用这个用量对比其他模型

不同场景的每月费用

使用场景每月
聊天机器人每次 1,000 输入 / 500 输出 token,每天 10,000 次请求$465.00/月
RAG 检索问答每次 8,000 输入 / 500 输出 token,每天 5,000 次请求$547.50/月
编程智能体每次 50,000 输入 / 2,000 输出 token,每天 1,000 次请求,80% 输入命中缓存$276.00/月

上下文与能力

上下文
1,048,576 token
最大输出
65,536 token
输入
文本、图像、视频、音频、PDF
输出
文本
知识截止
2026年3月
开放权重
否
工具调用
是
推理
是
结构化输出
是

能力和限制取自 models.dev。

价格相近的模型

Gemini 3.5 Flash Lite 与其他模型对比

价格历史

自 2026年10月8日 开始记录以来,价格没有变过。

常见问题

Gemini 3.5 Flash Lite 每月要花多少钱?
一个每天处理 10,000 次请求、每次 1,000 输入 token 和 500 输出 token 的聊天机器人,按厂商官方价格(已核实)计算,用 Gemini 3.5 Flash Lite 每月约 $465.00(每百万输入 token $0.30,每百万输出 token $2.50)。
Gemini 3.5 Flash Lite 支持提示缓存吗?
支持。命中缓存的输入每百万 token $0.03,普通输入是 $0.30。
Gemini 3.5 Flash Lite 的上下文窗口有多长?
Gemini 3.5 Flash Lite 最多接受 1,048,576 个 token(1.05M)的上下文,每次回复最多输出 65,536 个 token。
Gemini 3.5 Flash Lite 有批量价吗?
有。异步批量请求每百万输入 token $0.15,每百万输出 token $1.25。