
文章摘要
2026年7月31日,DeepSeek 官方在 X 上发布公告。最令人震撼的消息是 **「V4 Flash 的智能体性能大幅超越了 V4 Pro Preview」**。也就是说,免费到超低价的 Flash 模型反超了旗舰模型。
【快讯・2026年7月31日】DeepSeek V4 Flash 官方 API 公测上线!智能体性能超越 V4 Pro Preview,原生支持 Claude Code・Codex・OpenCode・Hermes 等 6 款工具
终于来了。DeepSeek V4 Flash 官方 API 以公测形式正式上线。
2026年7月31日,DeepSeek 官方在 X 上发布公告。最令人震撼的消息是 「V4 Flash 的智能体性能大幅超越了 V4 Pro Preview」。也就是说,免费到超低价的 Flash 模型反超了旗舰模型。

此外,它原生支持 Claude Code・Codex・OpenCode・OpenClaw・Hermes・Reasonix 这 6 大智能体工具,同时支持 Responses API 格式,并为 Codex 做了完全适配。
本文基于 DeepSeek 官方 X 公告 和 官方 API 文档 的真实数据,用初学者也能看懂的方式讲解价格、性能、支持的智能体和接入步骤。
读完本文你将了解:
- V4 Flash 到底「超越」V4 Pro Preview 多少
- 每 1M token 的价格(缓存命中时 $0.0028 起)
- 在 Claude Code・Codex・OpenCode・Hermes 等 6 款工具中的配置方法
- OpenAI 兼容 / Anthropic 兼容的 base_url 与模型名
- 高峰/低谷计费的注意事项
- Responses API・Thinking Mode 等功能列表
公告核心(X 帖文全文)
DeepSeek 官方(@deepseek_ai)的帖文:
🚀 DeepSeek-V4-Flash Official API is now LIVE in public beta!
🔷 We've massively upgraded its Agent capabilities — benchmark scores are now far surpassing the V4-Pro-Preview.
🔷 The official V4-Flash now natively supports the Responses API format and is fully adapted for Codex!
翻译过来就是:
- V4 Flash 的智能体性能大幅提升,基准分数 大幅超越 V4 Pro Preview
- 原生支持 Responses API 格式
- 为 Codex 完全优化
这条帖文获得了 575 万次浏览、1,348 条回复,反响巨大。Unsloth AI 也做出了回应。
价格(2026年8月・官方 API 文档)
| 价格(每 1M token) | V4 Flash | V4 Pro |
|---|---|---|
| 输入(缓存命中) | $0.0028 | $0.003625 |
| 输入(缓存未命中) | $0.14 | $0.435 |
| 输出 | $0.28 | $0.87 |
| 并发上限 | 2500 | 500 |
V4 Flash 的性价比是压倒性的。 缓存命中时的输入价格为 $0.0028 / 1M token。与 V4 Pro 相比,输入约便宜到三分之一,输出约便宜到三分之一。
⚠️ 高峰/低谷计费即将上线。 高峰时段(北京时间 9:00-12:00、14:00-18:00,UTC+8)价格翻倍。换算成日本时间即 10:00-13:00、15:00-19:00。
规格对比(V4 Flash vs V4 Pro)
| 项目 | V4 Flash(0731) | V4 Pro |
|---|---|---|
| 上下文长度 | 1M token | 1M token |
| 最大输出 | 384K token | 384K token |
| Thinking Mode | 默认开启(可切换) | 默认开启(可切换) |
| Responses API | ✓(仅 Flash) | ✗(预计8月上旬支持) |
| Anthropic API | ✓ | ✓ |
| JSON 输出 | ✓ | ✓ |
| Tool Calls | ✓ | ✓ |
| FIM 补全 | 仅非 Thinking 时 | 仅非 Thinking 时 |
| Chat Prefix 补全 | ✓(Beta) | ✓(Beta) |
注意: Responses API 仅 Flash 支持(V4 Pro 预计8月上旬支持)。也就是说 现阶段要用 Codex 就只能选 V4 Flash。
支持的智能体列表(6 款工具・官方 API 文档)
官方 API 文档「Agent Integrations」章节列出的全部支持工具:
| 智能体 | 类型 | 接入方式 |
|---|---|---|
| Claude Code | CLI 编码智能体 | 通过 Anthropic 兼容 API |
| Codex | CLI 编码智能体 | 原生支持 Responses API |
| OpenCode | CLI 编码智能体 | 通过 OpenAI 兼容 API |
| OpenClaw | 桌面型智能体 | 通过 OpenAI 兼容 API |
| Hermes | 自主多智能体 | 通过 OpenAI 兼容 API |
| Reasonix | 编码辅助 | 通过 OpenAI 兼容 API |
接入步骤(3 分钟完成)
通用配置
# API 密钥(从 https://platform.deepseek.com/ 获取)
export DEEPSEEK_API_KEY="你的API密钥"
① Claude Code 接入
export ANTHROPIC_BASE_URL="https://api.deepseek.com/anthropic"
export ANTHROPIC_AUTH_TOKEN=$DEEPSEEK_API_KEY
export ANTHROPIC_MODEL="deepseek-v4-flash"
# 启动
claude
② Codex 接入(Responses API 原生)
export OPENAI_API_KEY=$DEEPSEEK_API_KEY
export OPENAI_BASE_URL="https://api.deepseek.com"
# 模型名指定
codex --model deepseek-v4-flash
③ OpenCode / Hermes / OpenClaw / Reasonix 接入
export OPENAI_API_KEY=$DEEPSEEK_API_KEY
export OPENAI_BASE_URL="https://api.deepseek.com"
# 指定模型名
# OpenCode: opencode --model deepseek-v4-flash
# Hermes: hermes config set provider_model deepseek-v4-flash
④ 直接调用 API(curl)
curl https://api.deepseek.com/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer ***" \
-d '{
"model": "deepseek-v4-flash",
"messages": [
{"role": "system", "content": "You are a helpful assistant."},
{"role": "user", "content": "Hello!"}
],
"thinking": {"type": "enabled"},
"reasoning_effort": "high",
"stream": false
}'
与其他模型的价格对比(每 1M 输出 token)
| 模型 | 输出价格(1M token) | 输入价格(缓存未命中) |
|---|---|---|
| DeepSeek V4 Flash | $0.28 | $0.14 |
| DeepSeek V4 Pro | $0.87 | $0.435 |
| GPT-5.6 Sol | $15.00 | $1.25 |
| Claude Fable 5 | $15.00 | $3.00 |
| Claude Opus 4.8 | $75.00 | $15.00 |
V4 Flash 的价格约为 GPT-5.6 Sol 的五十分之一、Claude Opus 4.8 的两百七十分之一。 这种价格破坏力是它最大的武器。
注意事项(官方文档)
⚠️ 高峰/低谷计费(即将上线)
- 高峰时段(日本时间 10:00-13:00、15:00-19:00)价格翻倍
- 深夜、清晨使用 API 相当于半价
- 实际上线日期未定(「近期公布」)
⚠️ Responses API 仅 Flash 支持
- V4 Pro 的 Responses API 支持「预计8月上旬」
- 要用 Codex 就只能选 V4 Flash(现阶段)
⚠️ Thinking Mode 默认开启
- 思考 token 会计入计费
- 不需要时可设置
thinking: {type: "disabled"}关闭
⚠️ 每个账户的并发上限
- Flash: 2500、Pro: 500
常见问题(FAQ)
Q1. 可以免费使用吗?
不是完全免费,但 充 $5 就够用几个月。缓存命中时输入每 1M token 仅 $0.0028。
Q2. Claude Code 真的能用吗?
可以。作为 Anthropic 兼容 API 获得官方支持。
Q3. V4 Pro 和 V4 Flash 应该选哪个?
追求性价比选 Flash。追求最高性能选 Pro。但 Responses API(用于 Codex)仅 Flash 支持。
Q4. 支持中文吗?
支持。多语言支持。
Q5. API 密钥在哪里获取?
https://platform.deepseek.com/ 注册后即时发放。
Q6. 其他国家也能用吗?
全球可用(部分地区除外)。
Q7. Thinking Mode 是什么?
模型在内部「思考」后再回答的功能。精度提升但输出 token 会增加。
Q8. V4 Flash 的模型名应该填什么?
deepseek-v4-flash(自动路由到最新版 DeepSeek-V4-Flash-0731)。
总结 — 2026年8月,AI 智能体的「标准引擎」已经确定
结论:DeepSeek V4 Flash 官方 API 同时具备价格破坏力、智能体性能、工具支持三大优势,是 2026 下半年的 AI 智能体标准引擎。
- 价格: 1M 输出 $0.28(约为 GPT-5.6 Sol 的五十分之一)
- 性能: 超越 V4 Pro Preview 的智能体基准分数
- 支持: Claude Code・Codex・OpenCode・OpenClaw・Hermes・Reasonix 共 6 款工具
- 上手: 用 OpenAI 兼容 API 3 分钟完成配置
现在就开始:
# 获取 API 密钥后
curl https://api.deepseek.com/chat/completions \
-H "Authorization: Bearer ***" \
-d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"Hello"}]}'
「Flash 超越了 Pro。」这就是 2026 年 8 月的 AI 最前线。
本文信息截至 2026年8月1日。价格与规格请查阅 DeepSeek 官方 API 文档 的最新信息。
この記事をシェアする
相关文章

2026年7月19日
【2026】Agents-A1(35B MoE)是什么?小参数却能做这些 —— 惊艳的智能体专用模型深度分析

2026年7月18日
【2026】Qwen3.6-35B Genesis Hermes GGUF 完全指南!在本地 PC 运行无审查多模态 MoE 的方法

2026年6月16日
【2026】AI 模型 API 价格完全比较!ChatGPT vs Claude vs Gemini vs DeepSeek vs MiMo

2026年6月17日
【2026】小米 MiMo API 完全解读!与 DeepSeek 同价的多模态 AI 模型

2026年6月25日
【2026】DS4Flash(DeepSeek V4 Flash)本地运行完全指南!最大化 96–128GB VRAM

2026年6月26日
【2026】Ornith-1.0 完全解读!超越 Claude Opus・MIT 许可的最强 AI 编码模型