
文章摘要
8 月刚把 API 价格上调最多 12 倍的 DeepSeek,一个月内就掉头大幅降价。9 月 9 日,DeepSeek 向 API 用户发出通知:V4.1 Flash 将于 9 月 10 日正式发布。官方称新模型在性能、成本、速度、任务完成时间上全面超越 V4 Pro——而且在 V4.1 Pro 发布之前,所有发往 Pro 模型的请求都会自动路由到 V4.1 Flash,并按 Flash 的低价计费。
【2026】DeepSeek V4.1 Flash 正式发布:Pro 请求自动路由,价格最高降 86%
8 月刚把 API 价格上调最多 12 倍的 DeepSeek,一个月内就掉头大幅降价。9 月 9 日,DeepSeek 向 API 用户发出通知:V4.1 Flash 将于 9 月 10 日正式发布。官方称新模型在性能、成本、速度、任务完成时间上全面超越 V4 Pro——而且在 V4.1 Pro 发布之前,所有发往 Pro 模型的请求都会自动路由到 V4.1 Flash,并按 Flash 的低价计费。
新价格表(2026 年 9 月 10 日 4:00 UTC 生效)
| 项目(每 1M token) | 非高峰 | 高峰 |
|---|---|---|
| 输入(缓存命中) | $0.003 | $0.006 |
| 输入(缓存未命中) | $0.15 | $0.30 |
| 输出 | $0.60 | $1.20 |
高峰时段:周一至周五 UTC 1:00–4:00 和 6:00–10:00(北京时间 9:00–12:00、14:00–18:00),其余时间按半价计费。
对比涨价后的 V4 Pro(非高峰输入 $0.66–$1.32、输出 $1.98–$3.96):
- 缓存命中输入:−86%
- 缓存未命中输入:−77%
- 输出:−70%
Pro 请求会怎样
官方通知明确:V4.1 Flash 上线后到 V4.1 Pro 发布前,所有发往 Pro 的请求都由 V4.1 Flash 处理并按 Flash 价格计费。代码仍然调用 deepseek-v4-pro,但背后换了一个模型,且未提供退出选项。
注意:deepseek-v4-flash 的调用不会被重定向,旧 Flash 继续为显式指定它的用户服务。
V4.1 Flash 的已知信息
- 速度:社区实测 280–500 token/秒,V4 Flash 约 120–140——快约 3–6 倍。首 token 延迟据报 178ms(V4 Pro 为 766ms)
- 原生多模态:图像与文本在同一架构内处理,取代此前的 Vision-Exp 外挂方案
- 全新预训练而非 V4 Flash 的再训练(TechNode 报道)——提示与工具调用行为可能有差异
- 时间线:9 月 8 日两天限时测试(
deepseek-v4.1-flash-expires-on-0910)→ 9 月 9 日正式通知 → 9 月 10 日发布并调价
注意事项
- 尚无独立评测。"全面超越 V4 Pro"是厂商主张,技术报告、参数量、第三方分数截至 9 月 10 日均未发布
- 更快 ≠ 单任务更省:token 到达速度提高 3–6 倍,但单任务成本取决于 token 效率,目前无人验证
- 行为漂移:全新预训练会改变输出风格与工具调用习惯。生产流量前先跑一遍自己的评测集
谁受影响
- Pro API 用户:账单自动下降,但端点背后的模型变了——请重新测试工作负载
- Flash 用户:无强制迁移,但单凭速度就值得考虑切换到 V4.1 Flash
- 聊天应用用户:不受影响,调价仅针对 API
结论
DeepSeek 8 月把自己最有卖点的"便宜"涨没了,然后花一个月造出一个更便宜、更快的模型来翻盘。如果社区数据站得住,V4.1 Flash 就是延迟敏感、高吞吐场景的新默认选择。在独立评测出来之前,关键流水线继续显式使用 deepseek-v4-flash,让自动路由的 Pro 流量充当免费的 A/B 测试。
相关阅读:DeepSeek V4 Flash API 指南 · DeepSeek Harness 使用指南
注:价格与速度数据来自 DeepSeek 官方通知及社区首日报告,截至 2026 年 9 月 10 日尚无第三方验证。
相关文章

2026年8月1日
【快讯・2026年7月31日】DeepSeek V4 Flash 官方 API 公测上线!智能体性能超越 V4 Pro Preview,原生支持 Claude Code・Codex・OpenCode・Hermes 等 6 款工具

2026年8月31日
DeepSeek-V4-Flash-Vision-Exp 指南 2026:DeepSeek 首个多模态 AI 智能体模型详解

2026年8月16日
【2026年8月16日時点】Cheaper Inference 让 AI 模型最高便宜 60%!最新价格对比与机制完全解析

2026年6月16日
【2026】AI 模型 API 价格完全比较!ChatGPT vs Claude vs Gemini vs DeepSeek vs MiMo

2026年8月18日
【2026】DeepSeek V4 Flash 去审查版(Abliterated GGUF)完全评测!本地运行方法及注意事项

2026年9月25日
【2026】Prism 完全指南:同时支持 OpenAI 与 Anthropic 的智能体推理 API