GLM-4.7-FlashX API 价格

Z.AI · 发布于 2026年1月19日 · 200K 上下文 · API 模型 ID glm-4.7-flashx

Z.AI 的 GLM-4.7-FlashX API 价格:每百万输入 token $0.07,每百万输出 token $0.40(厂商标价,经 models.dev 整理,2026年10月10日)。

价格

GLM-4.7-FlashX 价格,美元 / 每百万 token
价格项美元 / 每百万 token
输入$0.07
输出$0.40
缓存读取$0.01
缓存写入免费

Z.AI 自家 API 的标价,由 models.dev 整理,检查于 2026年10月10日 09:00 UTC。云平台和转售商的价格可能不同。 厂商文档

每月费用估算

$81.00

每月

每天
$2.70
每次请求
$0.00027

费用 = 输入 token × 输入价 + 输出 token × 输出价,每月按 30 天算。命中缓存的输入按缓存读取价计,不含缓存写入费。

用这个用量对比其他模型

不同场景的每月费用

使用场景每月
聊天机器人每次 1,000 输入 / 500 输出 token,每天 10,000 次请求$81.00/月
RAG 检索问答每次 8,000 输入 / 500 输出 token,每天 5,000 次请求$114.00/月
编程智能体每次 50,000 输入 / 2,000 输出 token,每天 1,000 次请求,80% 输入命中缓存$57.00/月

上下文与能力

上下文
200,000 token
最大输出
131,072 token
输入
文本
输出
文本
知识截止
2025年4月
开放权重
是
工具调用
是
推理
是
结构化输出
否

能力和限制取自 models.dev。

价格相近的模型

价格历史

自 2026年10月8日 开始记录以来,价格没有变过。

常见问题

GLM-4.7-FlashX 每月要花多少钱?
一个每天处理 10,000 次请求、每次 1,000 输入 token 和 500 输出 token 的聊天机器人,按 Z.AI 的标价计算,用 GLM-4.7-FlashX 每月约 $81.00(每百万输入 token $0.07,每百万输出 token $0.40)。
GLM-4.7-FlashX 支持提示缓存吗?
支持。命中缓存的输入每百万 token $0.01,普通输入是 $0.07。写入缓存每百万 token 免费。
GLM-4.7-FlashX 的上下文窗口有多长?
GLM-4.7-FlashX 最多接受 200,000 个 token(200K)的上下文,每次回复最多输出 131,072 个 token。