GLM-5.3-FlashX vs GPT-6 Luna 价格对比

价格

GLM-5.3-FlashX 与 GPT-6 Luna 价格,美元 / 每百万 token
美元 / 每百万 tokenGLM-5.3-FlashXGPT-6 Luna
输入$0.37$0.10
输出$1.25$0.50
缓存读取$0.075$0.01
缓存写入免费$0.125
批量输入未公布$0.05
批量输出未公布$0.25

Z.AI 自家 API 的标价,由 models.dev 整理,检查于 2026年10月10日 09:00 UTC。云平台和转售商的价格可能不同。 厂商文档

已于 2026年10月9日 对照厂商官方价格页核实。 官方价格页

不同场景的每月费用

使用场景GLM-5.3-FlashXGPT-6 Luna
聊天机器人每次 1,000 输入 / 500 输出 token,每天 10,000 次请求$298.50/月$105.00/月
RAG 检索问答每次 8,000 输入 / 500 输出 token,每天 5,000 次请求$537.75/月$157.50/月
编程智能体每次 50,000 输入 / 2,000 输出 token,每天 1,000 次请求,80% 输入命中缓存$276.00/月$72.00/月

费用 = 输入 token × 输入价 + 输出 token × 输出价,每月按 30 天算。命中缓存的输入按缓存读取价计,不含缓存写入费。

上下文与能力

GLM-5.3-FlashXGPT-6 Luna
上下文1,000,000 token1,050,000 token
最大输出131,072 token128,000 token
输入文本、图像、视频、PDF文本、图像、PDF
工具调用是是
推理是是
结构化输出是是

常见问题

GLM-5.3-FlashX 和 GPT-6 Luna 的价格差多少?
GLM-5.3-FlashX:每百万输入 token $0.37,每百万输出 token $1.25。GPT-6 Luna:每百万输入 token $0.10,每百万输出 token $0.50。按“聊天机器人”场景(每次 1,000 输入 / 500 输出 token,每天 10,000 次请求)算,GLM-5.3-FlashX 每月约 $298.50,GPT-6 Luna 每月约 $105.00。
GLM-5.3-FlashX 和 GPT-6 Luna 哪个上下文窗口更长?
GPT-6 Luna 的上下文窗口更长:最多 1,050,000 个 token,GLM-5.3-FlashX 是 1,000,000 个。
GLM-5.3-FlashX 和 GPT-6 Luna 有提示缓存价和批量价吗?
GLM-5.3-FlashX:命中缓存的输入每百万 token $0.075;没有公布批量价。GPT-6 Luna:命中缓存的输入每百万 token $0.01;批量请求每百万输入 token $0.05、每百万输出 token $0.25。

更多对比