DeepSeek V4.1 Flash vs Qwen3.8 Flash 价格对比
- 在“聊天机器人”场景下,DeepSeek V4.1 Flash 的费用约是 Qwen3.8 Flash 的 2.3 倍。
- 在“RAG 检索问答”场景下,DeepSeek V4.1 Flash 的费用约是 Qwen3.8 Flash 的 2.1 倍。
- 在“编程智能体”场景下,DeepSeek V4.1 Flash 的费用约是 Qwen3.8 Flash 的 1.8 倍。
价格
| 美元 / 每百万 token | DeepSeek V4.1 Flash | Qwen3.8 Flash |
|---|---|---|
| 输入 | $0.30 | $0.15 |
| 输出 | $1.20 | $0.47 |
| 缓存读取 | $0.006 | $0.016 |
| 缓存写入 | 未公布 | $0.20 |
| 批量输入 | 未公布 | 未公布 |
| 批量输出 | 未公布 | 未公布 |
| 非高峰输入 | $0.15 | 未公布 |
| 非高峰输出 | $0.60 | 未公布 |
| 非高峰缓存读取 | $0.003 | 未公布 |
DeepSeek V4.1 Flash:表中“输入”“输出”“缓存读取”三行是标准价(高峰价),“非高峰”几行适用于其他时段。非高峰时段:工作日 UTC 01:00–04:00、06:00–10:00 以外的全部时间,以及周末和中国法定节假日全天。
已于 2026年10月9日 对照厂商官方价格页核实。 官方价格页
Alibaba 自家 API 的标价,由 models.dev 整理,检查于 2026年10月10日 09:00 UTC。云平台和转售商的价格可能不同。 厂商文档
不同场景的每月费用
| 使用场景 | DeepSeek V4.1 Flash | Qwen3.8 Flash |
|---|---|---|
| 聊天机器人每次 1,000 输入 / 500 输出 token,每天 10,000 次请求 | $270.00/月 | $115.50/月 |
| RAG 检索问答每次 8,000 输入 / 500 输出 token,每天 5,000 次请求 | $450.00/月 | $215.25/月 |
| 编程智能体每次 50,000 输入 / 2,000 输出 token,每天 1,000 次请求,80% 输入命中缓存 | $169.20/月 | $92.40/月 |
费用 = 输入 token × 输入价 + 输出 token × 输出价,每月按 30 天算。命中缓存的输入按缓存读取价计,不含缓存写入费。
上下文与能力
| DeepSeek V4.1 Flash | Qwen3.8 Flash | |
|---|---|---|
| 上下文 | 1,000,000 token | 1,000,000 token |
| 最大输出 | 393,216 token | 131,072 token |
| 输入 | 文本、图像 | 文本、图像、视频 |
| 工具调用 | 是 | 是 |
| 推理 | 是 | 是 |
| 结构化输出 | 是 | 是 |
常见问题
- DeepSeek V4.1 Flash 和 Qwen3.8 Flash 的价格差多少?
- DeepSeek V4.1 Flash:每百万输入 token $0.30,每百万输出 token $1.20。Qwen3.8 Flash:每百万输入 token $0.15,每百万输出 token $0.47。按“聊天机器人”场景(每次 1,000 输入 / 500 输出 token,每天 10,000 次请求)算,DeepSeek V4.1 Flash 每月约 $270.00,Qwen3.8 Flash 每月约 $115.50。
- DeepSeek V4.1 Flash 和 Qwen3.8 Flash 哪个上下文窗口更长?
- 两个模型都最多接受 1,000,000 个 token 的上下文。
- DeepSeek V4.1 Flash 和 Qwen3.8 Flash 有提示缓存价和批量价吗?
- DeepSeek V4.1 Flash:命中缓存的输入每百万 token $0.006;没有公布批量价。Qwen3.8 Flash:命中缓存的输入每百万 token $0.016;没有公布批量价。