GLM-5.3-FlashX API 价格
Z.AI · 发布于 2026年9月18日 · 1M 上下文 · API 模型 ID glm-5.3-flashx
Z.AI 的 GLM-5.3-FlashX API 价格:每百万输入 token $0.37,每百万输出 token $1.25(厂商标价,经 models.dev 整理,2026年10月10日)。
价格
| 价格项 | 美元 / 每百万 token |
|---|---|
| 输入 | $0.37 |
| 输出 | $1.25 |
| 缓存读取 | $0.075 |
| 缓存写入 | 免费 |
Z.AI 自家 API 的标价,由 models.dev 整理,检查于 2026年10月10日 09:00 UTC。云平台和转售商的价格可能不同。 厂商文档
每月费用估算
$298.50
每月
- 每天
- $9.95
- 每次请求
- $0.000995
无法估算:缺少需要的价格。
费用 = 输入 token × 输入价 + 输出 token × 输出价,每月按 30 天算。命中缓存的输入按缓存读取价计,不含缓存写入费。
不同场景的每月费用
| 使用场景 | 每月 |
|---|---|
| 聊天机器人每次 1,000 输入 / 500 输出 token,每天 10,000 次请求 | $298.50/月 |
| RAG 检索问答每次 8,000 输入 / 500 输出 token,每天 5,000 次请求 | $537.75/月 |
| 编程智能体每次 50,000 输入 / 2,000 输出 token,每天 1,000 次请求,80% 输入命中缓存 | $276.00/月 |
上下文与能力
- 上下文
- 1,000,000 token
- 最大输出
- 131,072 token
- 输入
- 文本、图像、视频、PDF
- 输出
- 文本
- 知识截止
- 未公布
- 开放权重
- 是
- 工具调用
- 是
- 推理
- 是
- 结构化输出
- 是
能力和限制取自 models.dev。
价格相近的模型
- DeepSeek V4.1 Flash · $0.30 输入 / $1.20 输出 · 对比
- MiniMax-M3 · $0.30 输入 / $1.20 输出 · 对比
- Gemini 3.5 Flash Lite · $0.30 输入 / $2.50 输出 · 对比
- Seed 2.0 Pro · $0.50 输入 / $3.00 输出 · 对比
GLM-5.3-FlashX 与其他模型对比
- GLM-5.3-FlashX vs Claude Haiku 5.5
- GLM-5.3-FlashX vs Claude Opus 5.5
- GLM-5.3-FlashX vs Claude Sonnet 5.5
- GLM-5.3-FlashX vs DeepSeek V4.1 Flash
- GLM-5.3-FlashX vs DeepSeek V4 Pro
- GLM-5.3-FlashX vs Gemini 3.1 Pro Preview
- GLM-5.3-FlashX vs Gemini 3.5 Flash Lite
- GLM-5.3-FlashX vs Gemini 3.8 Flash
- GLM-5.3-FlashX vs GPT-6.1 Sol
- GLM-5.3-FlashX vs GPT-6 Astra
- GLM-5.3-FlashX vs GPT-6 Luna
- GLM-5.3-FlashX vs Grok 4.7
- GLM-5.3-FlashX vs Grok Build 0.1
- GLM-5.3-FlashX vs Kimi K3
- GLM-5.3-FlashX vs MiniMax-M3
- GLM-5.3-FlashX vs Mistral Medium 3.5
- GLM-5.3-FlashX vs Muse Spark 1.3
- GLM-5.3-FlashX vs Qwen3.8 Flash
- GLM-5.3-FlashX vs Qwen3.8 Max
- GLM-5.3-FlashX vs Seed 2.0 Pro
价格历史
自 2026年10月8日 开始记录以来,价格没有变过。
常见问题
- GLM-5.3-FlashX 每月要花多少钱?
- 一个每天处理 10,000 次请求、每次 1,000 输入 token 和 500 输出 token 的聊天机器人,按 Z.AI 的标价计算,用 GLM-5.3-FlashX 每月约 $298.50(每百万输入 token $0.37,每百万输出 token $1.25)。
- GLM-5.3-FlashX 支持提示缓存吗?
- 支持。命中缓存的输入每百万 token $0.075,普通输入是 $0.37。写入缓存每百万 token 免费。
- GLM-5.3-FlashX 的上下文窗口有多长?
- GLM-5.3-FlashX 最多接受 1,000,000 个 token(1M)的上下文,每次回复最多输出 131,072 个 token。