DeepSeek V4.1 Flash vs Qwen3.8 Max 价格对比

价格

DeepSeek V4.1 Flash 与 Qwen3.8 Max 价格,美元 / 每百万 token
美元 / 每百万 tokenDeepSeek V4.1 FlashQwen3.8 Max
输入$0.30$2.00
输出$1.20$6.00
缓存读取$0.006$0.25
缓存写入未公布$2.50
批量输入未公布未公布
批量输出未公布未公布
非高峰输入$0.15未公布
非高峰输出$0.60未公布
非高峰缓存读取$0.003未公布

DeepSeek V4.1 Flash:表中“输入”“输出”“缓存读取”三行是标准价(高峰价),“非高峰”几行适用于其他时段。非高峰时段:工作日 UTC 01:00–04:00、06:00–10:00 以外的全部时间,以及周末和中国法定节假日全天。

已于 2026年10月9日 对照厂商官方价格页核实。 官方价格页

Alibaba 自家 API 的标价,由 models.dev 整理,检查于 2026年10月10日 09:00 UTC。云平台和转售商的价格可能不同。 厂商文档

不同场景的每月费用

使用场景DeepSeek V4.1 FlashQwen3.8 Max
聊天机器人每次 1,000 输入 / 500 输出 token,每天 10,000 次请求$270.00/月$1,500/月
RAG 检索问答每次 8,000 输入 / 500 输出 token,每天 5,000 次请求$450.00/月$2,850/月
编程智能体每次 50,000 输入 / 2,000 输出 token,每天 1,000 次请求,80% 输入命中缓存$169.20/月$1,260/月

费用 = 输入 token × 输入价 + 输出 token × 输出价,每月按 30 天算。命中缓存的输入按缓存读取价计,不含缓存写入费。

上下文与能力

DeepSeek V4.1 FlashQwen3.8 Max
上下文1,000,000 token1,000,000 token
最大输出393,216 token131,072 token
输入文本、图像文本、图像、视频、PDF
工具调用是是
推理是是
结构化输出是是

常见问题

DeepSeek V4.1 Flash 和 Qwen3.8 Max 的价格差多少?
DeepSeek V4.1 Flash:每百万输入 token $0.30,每百万输出 token $1.20。Qwen3.8 Max:每百万输入 token $2.00,每百万输出 token $6.00。按“聊天机器人”场景(每次 1,000 输入 / 500 输出 token,每天 10,000 次请求)算,DeepSeek V4.1 Flash 每月约 $270.00,Qwen3.8 Max 每月约 $1,500。
DeepSeek V4.1 Flash 和 Qwen3.8 Max 哪个上下文窗口更长?
两个模型都最多接受 1,000,000 个 token 的上下文。
DeepSeek V4.1 Flash 和 Qwen3.8 Max 有提示缓存价和批量价吗?
DeepSeek V4.1 Flash:命中缓存的输入每百万 token $0.006;没有公布批量价。Qwen3.8 Max:命中缓存的输入每百万 token $0.25;没有公布批量价。

更多对比