云导航 CloudNavi
← 返回文章列表
【快讯・2026年7月31日】DeepSeek V4 Flash 官方 API 公测上线!智能体性能超越 V4 Pro Preview,原生支持 Claude Code・Codex・OpenCode・Hermes 等 6 款工具
AI 模型·1 分钟阅读
#DeepSeek#V4 Flash#API#Codex#Claude Code#Hermes#OpenCode#Responses API#公测

文章摘要

2026年7月31日,DeepSeek 官方在 X 上发布公告。最令人震撼的消息是 **「V4 Flash 的智能体性能大幅超越了 V4 Pro Preview」**。也就是说,免费到超低价的 Flash 模型反超了旗舰模型。

【快讯・2026年7月31日】DeepSeek V4 Flash 官方 API 公测上线!智能体性能超越 V4 Pro Preview,原生支持 Claude Code・Codex・OpenCode・Hermes 等 6 款工具


终于来了。DeepSeek V4 Flash 官方 API 以公测形式正式上线。

2026年7月31日,DeepSeek 官方在 X 上发布公告。最令人震撼的消息是 「V4 Flash 的智能体性能大幅超越了 V4 Pro Preview」。也就是说,免费到超低价的 Flash 模型反超了旗舰模型。

DeepSeek 官方首页(V4 Flash API 公测公告)

此外,它原生支持 Claude Code・Codex・OpenCode・OpenClaw・Hermes・Reasonix 这 6 大智能体工具,同时支持 Responses API 格式,并为 Codex 做了完全适配。

本文基于 DeepSeek 官方 X 公告官方 API 文档 的真实数据,用初学者也能看懂的方式讲解价格、性能、支持的智能体和接入步骤。

读完本文你将了解:

  • V4 Flash 到底「超越」V4 Pro Preview 多少
  • 每 1M token 的价格(缓存命中时 $0.0028 起)
  • 在 Claude Code・Codex・OpenCode・Hermes 等 6 款工具中的配置方法
  • OpenAI 兼容 / Anthropic 兼容的 base_url 与模型名
  • 高峰/低谷计费的注意事项
  • Responses API・Thinking Mode 等功能列表

公告核心(X 帖文全文)

DeepSeek 官方(@deepseek_ai)的帖文:

🚀 DeepSeek-V4-Flash Official API is now LIVE in public beta!

🔷 We've massively upgraded its Agent capabilities — benchmark scores are now far surpassing the V4-Pro-Preview.

🔷 The official V4-Flash now natively supports the Responses API format and is fully adapted for Codex!

翻译过来就是:

  • V4 Flash 的智能体性能大幅提升,基准分数 大幅超越 V4 Pro Preview
  • 原生支持 Responses API 格式
  • 为 Codex 完全优化

这条帖文获得了 575 万次浏览、1,348 条回复,反响巨大。Unsloth AI 也做出了回应。


价格(2026年8月・官方 API 文档)

价格(每 1M token)V4 FlashV4 Pro
输入(缓存命中)$0.0028$0.003625
输入(缓存未命中)$0.14$0.435
输出$0.28$0.87
并发上限2500500

V4 Flash 的性价比是压倒性的。 缓存命中时的输入价格为 $0.0028 / 1M token。与 V4 Pro 相比,输入约便宜到三分之一,输出约便宜到三分之一。

⚠️ 高峰/低谷计费即将上线。 高峰时段(北京时间 9:00-12:00、14:00-18:00,UTC+8)价格翻倍。换算成日本时间即 10:00-13:00、15:00-19:00。


规格对比(V4 Flash vs V4 Pro)

项目V4 Flash(0731)V4 Pro
上下文长度1M token1M token
最大输出384K token384K token
Thinking Mode默认开启(可切换)默认开启(可切换)
Responses API✓(仅 Flash)✗(预计8月上旬支持)
Anthropic API
JSON 输出
Tool Calls
FIM 补全仅非 Thinking 时仅非 Thinking 时
Chat Prefix 补全✓(Beta)✓(Beta)

注意: Responses API 仅 Flash 支持(V4 Pro 预计8月上旬支持)。也就是说 现阶段要用 Codex 就只能选 V4 Flash


支持的智能体列表(6 款工具・官方 API 文档)

官方 API 文档「Agent Integrations」章节列出的全部支持工具:

智能体类型接入方式
Claude CodeCLI 编码智能体通过 Anthropic 兼容 API
CodexCLI 编码智能体原生支持 Responses API
OpenCodeCLI 编码智能体通过 OpenAI 兼容 API
OpenClaw桌面型智能体通过 OpenAI 兼容 API
Hermes自主多智能体通过 OpenAI 兼容 API
Reasonix编码辅助通过 OpenAI 兼容 API

接入步骤(3 分钟完成)

通用配置

# API 密钥(从 https://platform.deepseek.com/ 获取)
export DEEPSEEK_API_KEY="你的API密钥"

① Claude Code 接入

export ANTHROPIC_BASE_URL="https://api.deepseek.com/anthropic"
export ANTHROPIC_AUTH_TOKEN=$DEEPSEEK_API_KEY
export ANTHROPIC_MODEL="deepseek-v4-flash"

# 启动
claude

② Codex 接入(Responses API 原生)

export OPENAI_API_KEY=$DEEPSEEK_API_KEY
export OPENAI_BASE_URL="https://api.deepseek.com"

# 模型名指定
codex --model deepseek-v4-flash

③ OpenCode / Hermes / OpenClaw / Reasonix 接入

export OPENAI_API_KEY=$DEEPSEEK_API_KEY
export OPENAI_BASE_URL="https://api.deepseek.com"

# 指定模型名
# OpenCode: opencode --model deepseek-v4-flash
# Hermes: hermes config set provider_model deepseek-v4-flash

④ 直接调用 API(curl)

curl https://api.deepseek.com/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer ***" \
  -d '{
    "model": "deepseek-v4-flash",
    "messages": [
      {"role": "system", "content": "You are a helpful assistant."},
      {"role": "user", "content": "Hello!"}
    ],
    "thinking": {"type": "enabled"},
    "reasoning_effort": "high",
    "stream": false
  }'

与其他模型的价格对比(每 1M 输出 token)

模型输出价格(1M token)输入价格(缓存未命中)
DeepSeek V4 Flash$0.28$0.14
DeepSeek V4 Pro$0.87$0.435
GPT-5.6 Sol$15.00$1.25
Claude Fable 5$15.00$3.00
Claude Opus 4.8$75.00$15.00

V4 Flash 的价格约为 GPT-5.6 Sol 的五十分之一、Claude Opus 4.8 的两百七十分之一。 这种价格破坏力是它最大的武器。


注意事项(官方文档)

⚠️ 高峰/低谷计费(即将上线)

  • 高峰时段(日本时间 10:00-13:00、15:00-19:00)价格翻倍
  • 深夜、清晨使用 API 相当于半价
  • 实际上线日期未定(「近期公布」)

⚠️ Responses API 仅 Flash 支持

  • V4 Pro 的 Responses API 支持「预计8月上旬」
  • 要用 Codex 就只能选 V4 Flash(现阶段)

⚠️ Thinking Mode 默认开启

  • 思考 token 会计入计费
  • 不需要时可设置 thinking: {type: "disabled"} 关闭

⚠️ 每个账户的并发上限

  • Flash: 2500、Pro: 500

常见问题(FAQ)

Q1. 可以免费使用吗?

不是完全免费,但 充 $5 就够用几个月。缓存命中时输入每 1M token 仅 $0.0028。

Q2. Claude Code 真的能用吗?

可以。作为 Anthropic 兼容 API 获得官方支持。

Q3. V4 Pro 和 V4 Flash 应该选哪个?

追求性价比选 Flash。追求最高性能选 Pro。但 Responses API(用于 Codex)仅 Flash 支持。

Q4. 支持中文吗?

支持。多语言支持。

Q5. API 密钥在哪里获取?

https://platform.deepseek.com/ 注册后即时发放。

Q6. 其他国家也能用吗?

全球可用(部分地区除外)。

Q7. Thinking Mode 是什么?

模型在内部「思考」后再回答的功能。精度提升但输出 token 会增加。

Q8. V4 Flash 的模型名应该填什么?

deepseek-v4-flash(自动路由到最新版 DeepSeek-V4-Flash-0731)。


总结 — 2026年8月,AI 智能体的「标准引擎」已经确定

结论:DeepSeek V4 Flash 官方 API 同时具备价格破坏力、智能体性能、工具支持三大优势,是 2026 下半年的 AI 智能体标准引擎。

  • 价格: 1M 输出 $0.28(约为 GPT-5.6 Sol 的五十分之一)
  • 性能: 超越 V4 Pro Preview 的智能体基准分数
  • 支持: Claude Code・Codex・OpenCode・OpenClaw・Hermes・Reasonix 共 6 款工具
  • 上手: 用 OpenAI 兼容 API 3 分钟完成配置

现在就开始:

# 获取 API 密钥后
curl https://api.deepseek.com/chat/completions \
  -H "Authorization: Bearer ***" \
  -d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"Hello"}]}'

「Flash 超越了 Pro。」这就是 2026 年 8 月的 AI 最前线。


本文信息截至 2026年8月1日。价格与规格请查阅 DeepSeek 官方 API 文档 的最新信息。