Qwen3.8 Max API 价格
Alibaba · 发布于 2026年8月3日 · 1M 上下文 · API 模型 ID qwen3.8-max
Alibaba 的 Qwen3.8 Max API 价格:每百万输入 token $2.00,每百万输出 token $6.00(厂商标价,经 models.dev 整理,2026年10月10日)。
价格
| 价格项 | 美元 / 每百万 token |
|---|---|
| 输入 | $2.00 |
| 输出 | $6.00 |
| 缓存读取 | $0.25 |
| 缓存写入 | $2.50 |
Alibaba 自家 API 的标价,由 models.dev 整理,检查于 2026年10月10日 09:00 UTC。云平台和转售商的价格可能不同。 厂商文档
每月费用估算
$1,500
每月
- 每天
- $50.00
- 每次请求
- $0.005
无法估算:缺少需要的价格。
费用 = 输入 token × 输入价 + 输出 token × 输出价,每月按 30 天算。命中缓存的输入按缓存读取价计,不含缓存写入费。
不同场景的每月费用
| 使用场景 | 每月 |
|---|---|
| 聊天机器人每次 1,000 输入 / 500 输出 token,每天 10,000 次请求 | $1,500/月 |
| RAG 检索问答每次 8,000 输入 / 500 输出 token,每天 5,000 次请求 | $2,850/月 |
| 编程智能体每次 50,000 输入 / 2,000 输出 token,每天 1,000 次请求,80% 输入命中缓存 | $1,260/月 |
上下文与能力
- 上下文
- 1,000,000 token
- 最大输出
- 131,072 token
- 输入
- 文本、图像、视频、PDF
- 输出
- 文本
- 知识截止
- 未公布
- 开放权重
- 否
- 工具调用
- 是
- 推理
- 是
- 结构化输出
- 是
能力和限制取自 models.dev。
价格相近的模型
- Mistral Medium 3.5 · $1.50 输入 / $7.50 输出 · 对比
- Grok 4.7 · $2.00 输入 / $6.00 输出 · 对比
- Claude Sonnet 5.5 · $2.00 输入 / $10.00 输出 · 对比
- GPT-6.1 Sol · $2.00 输入 / $10.00 输出 · 对比
Qwen3.8 Max 与其他模型对比
- Qwen3.8 Max vs Claude Haiku 5.5
- Qwen3.8 Max vs Claude Opus 5.5
- Qwen3.8 Max vs Claude Sonnet 5.5
- Qwen3.8 Max vs DeepSeek V4.1 Flash
- Qwen3.8 Max vs DeepSeek V4 Pro
- Qwen3.8 Max vs Gemini 3.1 Pro Preview
- Qwen3.8 Max vs Gemini 3.5 Flash Lite
- Qwen3.8 Max vs Gemini 3.8 Flash
- Qwen3.8 Max vs GLM-5.3-FlashX
- Qwen3.8 Max vs GPT-6.1 Sol
- Qwen3.8 Max vs GPT-6 Astra
- Qwen3.8 Max vs GPT-6 Luna
- Qwen3.8 Max vs Grok 4.7
- Qwen3.8 Max vs Grok Build 0.1
- Qwen3.8 Max vs Kimi K3
- Qwen3.8 Max vs MiniMax-M3
- Qwen3.8 Max vs Mistral Medium 3.5
- Qwen3.8 Max vs Muse Spark 1.3
- Qwen3.8 Max vs Qwen3.8 Flash
- Qwen3.8 Max vs Seed 2.0 Pro
价格历史
自 2026年10月8日 开始记录以来,价格没有变过。
常见问题
- Qwen3.8 Max 每月要花多少钱?
- 一个每天处理 10,000 次请求、每次 1,000 输入 token 和 500 输出 token 的聊天机器人,按 Alibaba 的标价计算,用 Qwen3.8 Max 每月约 $1,500(每百万输入 token $2.00,每百万输出 token $6.00)。
- Qwen3.8 Max 支持提示缓存吗?
- 支持。命中缓存的输入每百万 token $0.25,普通输入是 $2.00。写入缓存每百万 token $2.50。
- Qwen3.8 Max 的上下文窗口有多长?
- Qwen3.8 Max 最多接受 1,000,000 个 token(1M)的上下文,每次回复最多输出 131,072 个 token。