
文章摘要
Gemini 3.8 Flash 在 HLE-Verified 取得 54.9%,超过 Claude Opus 5(54.4%),同时维持与 3.7 Flash 相同的 $0.75/1M 输入低价——是 Google 的「最强主力(workhorse)模型」。专门用于漏洞发现与自动修复的3.8 Flash Cyber也同步发布。
2026 年 Gemini 3.8 Flash 完全指南!Google 最强编程模型 HLE 54.9% 超越 Opus 5,网络安全版同步登场
2026 年 9 月 2 日,Google 发布了Gemini 3.8 Flash与Gemini 3.8 Flash Cyber。距 3.7 Flash 仅 3 周——6 周内第 3 次 Flash 发布,更新速度惊人。
先给结论:Gemini 3.8 Flash 在 HLE-Verified 取得 54.9%,超过 Claude Opus 5(54.4%),同时维持与 3.7 Flash 相同的 $0.75/1M 输入低价——是 Google 的「最强主力(workhorse)模型」。专门用于漏洞发现与自动修复的3.8 Flash Cyber也同步发布。
本文可以了解
- Gemini 3.8 Flash 是什么(30 秒理解)
- 相比 3.7 Flash 的改进
- 主要基准成绩(HLE 54.9%・Terminal-Bench 90.8%)
- 安全专用版「3.8 Flash Cyber」的性能
- 价格与使用渠道
- 与竞品(Opus 5・GPT-5.6 Sol)的对比
Gemini 3.8 Flash 是什么
Gemini 3.8 Flash 是 Google DeepMind 针对编程与推理优化的模型,从 3.8 起分为「Flash」与「Flash Cyber」两个变体。
- 发布日期:2026 年 9 月 2 日(官方 X + DeepMind 博客)
- 前代:Gemini 3.7 Flash(3 周前・约 8 月 13 日)
- 发布节奏:6 周内第 3 次 Flash 发布(3.6 → 3.7 → 3.8)
- 开发方:Google DeepMind
- 模型 ID:
gemini-3.8-flash
两个变体:
- Gemini 3.8 Flash:通用「主力」模型,面向软件开发・智能体工作・多步推理
- Gemini 3.8 Flash Cyber:网络安全专用,擅长漏洞发现与自动修复(Fairwind 计划)
设计理念:「3.8 Flash 更努力(works harder)」。复杂任务会执行额外推理步骤与迭代工具调用以最大化性能。
主要基准:HLE 54.9% 超越 Opus 5
HLE-Verified(多步推理)
Gemini 3.8 Flash 得分54.9%,领先竞品。
| 模型 | HLE-Verified |
|---|---|
| Gemini 3.8 Flash | 54.9% |
| GPT-5.6 Sol | 54.5% |
| Claude Opus 5 | 54.4% |
| Gemini 3.7 Flash | 53.6% |
| GPT-5.6 Terra | 51.1% |
| Claude Sonnet 5 | 31.0% |
其他基准
- DeepSWE v1.1(长程软件开发):以几分之一成本超越大多数更大的前沿模型
- Terminal-Bench 2.1:90.8%(从 3.7 Flash 的 81.6% 大幅提升)
- Vals Finance Agent V2:超越 3.7 Flash 与其他前沿模型
- Harvey 法律智能体基准:法律智能体中也属顶级
注意:在高努力等级下,3.8 Flash 会消耗更多 Token 以最大化性能。可用低努力等级控制成本。
安全专用版「Gemini 3.8 Flash Cyber」
Google 最强的网络安全模型,专精漏洞发现与自动修复。
CyberGym(漏洞发现)
Gemini 3.8 Flash Cyber 得分86.2%,领先全场。
| 模型 | CyberGym Pass@1 |
|---|---|
| Gemini 3.8 Flash Cyber | 86.2% |
| GPT-5.5-Cyber | 85.6% |
| Mythos 5 | 83.8% |
| GPT-5.6 Sol | 83.6% |
| Gemini 3.5 Flash Cyber | 77.5% |
其他安全指标
- CWE-Bench Pass@1(自动修复):47.2%(逼近最强前沿模型的 47.8%,成本大幅更低)
- 20 种语言内部基准:漏洞发现成功率超 70%
- Wiz 实测:内部渗透测试召回率 +7.5–9.7%,成本低 2.3–5.2 倍
- Chrome 安全团队:正确漏洞补丁数量是大型商业竞品的2.6 倍
- 云漏洞研究团队:不到 2 小时发现通常需数月研究的关键基础漏洞
安全设计:优先防御方的漏洞修复而非攻击性利用。内置 CBRN(化学・生物・放射・核)与网络攻击滥用的防护机制。
价格:与 3.7 相同的低价
Gemini 3.8 Flash 维持与 3.7 Flash 相同的优惠价。
| 期间 | 输入(1M Token) | 输出(1M Token) |
|---|---|---|
| 2026 年 12 月 31 日前(优惠价) | $0.75 | $3.75 |
| 2027 年 1 月 1 日起 | $1.50 | $7.50 |
- 上下文窗口:1,048,576 Token 输入(1M)・65,536 Token 输出
- 性价比:GPT-5.6 Sol 与 Opus 5 价格更高的情况下,约 $0.75/1M 即可使用前沿级性能
使用渠道
- 开发者:Google AI Studio・Google Antigravity・Android Studio
- 企业:Gemini Enterprise
- 普通用户:Gemini 应用(Google AI Pro/Ultra)・搜索 AI Mode・Google Sheets 中的 Gemini
- Cyber 版:Fairwind 计划(受信任防御者・需申请)
上手方法(开发者)
在 Google AI Studio 选择 gemini-3.8-flash 即可开始。从 3.7 Flash 迁移只需改模型 ID。
from google import genai
client = genai.Client()
response = client.models.generate_content(
model="gemini-3.8-flash", # 只需改模型 ID
contents="给这个仓库提出重构建议"
)
print(response.text)
想尝试智能体优先的工作流,可从Google Antigravity开始。
总结:Google 以 Flash 战略挑战前沿
Gemini 3.8 Flash 的发布让 Google「用便宜快速的 Flash 提供前沿性能」的战略更加清晰。
- ✅ 性能:HLE 54.9%(超 Opus 5)・Terminal-Bench 90.8%・DeepSWE 超越大型模型
- ✅ 价格:$0.75/1M 输入(维持 3.7 价格・至 2026 年底)
- ✅ 速度:6 周内第 3 次 Flash 发布
- ✅ 安全:CyberGym 86.2% 顶级漏洞发现(3.8 Flash Cyber)
- ✅ 安全设计:CBRN 与网络攻击滥用防护・提示词注入抵抗力提升
适合谁:
- 想便宜使用编程 AI 的开发者
- 正在构建智能体工作流的人
- 对漏洞发现/自动修复感兴趣的防御方
- 觉得 Opus 5 / GPT-5.6 Sol 太贵的人
诚实缺点:「更努力」的设计在高努力等级下会增加 Token 消耗;Cyber 版仅限 Fairwind 计划的受信任防御者使用。
在日益激烈的 AI 模型大战中,Google 的「Flash = 高性价比主力」战略对开发者极具吸引力。先从 AI Studio 试试吧。
链接
- Google 官方 X 帖:https://x.com/Google/status/2095175518068904380
- Google DeepMind 博客:Introducing Gemini 3.8 Flash and 3.8 Flash Cyber
- Google AI Studio:https://aistudio.google.com/
- Fairwind 计划:https://deepmind.google/fairwind-program/
相关文章
相关文章

2026年9月4日
【快报・2026】Google 发布「WeatherNext 3」!实时卫星数据・每小时更新的全球最高精度 AI 天气预报模型详解

2026年9月2日
2026 年 Meta Muse Spark 1.3 完全解读!编程 AI 新星 DeepSWE 75.4 超越 Opus 5

2026年6月26日
【2026】TimesFM 完全解读!Google 开发的时序预测基础模型

2026年9月1日
TimesFM-3 指南 2026:Google 的多变量时序预测基础模型

2026年9月7日
Meta「Muse Spark 1.3 max」正式公开:编程基准与 Claude Opus 5 并列第一(2026年9月)

2026年9月4日
Gemini 3.8 Flash 从 2 小时足球比赛中全自动找出所有黄牌!X 上爆火的「Agentic Video Understanding」演示详解(2026)