谷歌发布Gemini 3.8 Flash与3.8 Flash Cyber:六周内第三个Flash版本,编码推理对标旗舰、网络安全新防线

2026-09-03·8分钟阅读

2026年9月2日,谷歌在官方博客宣布推出Gemini 3.8 Flash与Gemini 3.8 Flash Cyber。这是谷歌六周内发布的第三个Flash版本——三周前3.7 Flash刚亮相,如今3.8带着更强的推理与编码能力登场,且入门价格与3.7完全一致。其中,Gemini 3.8 Flash被定位为'最聪明的工作主力模型',在软件工程、智能体任务与多步推理上较3.7 Flash显著提升;Gemini 3.8 Flash Cyber则是谷歌目前最强的网络安全模型,在漏洞检测与自动修复上达到前沿水平,仅通过全新的Fairwind计划向可信防御者开放。两者共享同一基础智能核心,并由长期运行的智能体循环(agentic loops)递归评估与优化驱动加速。

先看定位与价格。Gemini 3.8 Flash延续了Flash系列'低价高速'的路线:官方博客明确写道,它'在同一速度和低成本下提供了我们迄今最好的推理与编码模型',表现经常接近成本高得多的前沿模型。价格方面,3.8 Flash沿用3.7 Flash的入门价——输入每百万token 0.75美元、输出每百万token 3.75美元,但这一促销价到2026年12月31日截止,自2027年1月1日起将调整为输入1.50美元、输出7.50美元每百万token。这个定价节奏清楚地表明:谷歌正用'能力升级但不涨价'的方式,在Flash这条走量产品线上对OpenAI等对手施加压力。谷歌还强调,如果开发者优先考虑算力效率,可以选择较低的努力档位来压缩token开销,或者继续使用仍获全面支持的3.7 Flash。

在通用能力上,3.8 Flash交出的成绩单相当亮眼。官方公布的数据显示,在衡量长程软件工程的DeepSWE v1.1基准上,3.8 Flash能以极小成本端到端自主解决复杂工程问题,表现超过大多数规模更大的前沿模型;在HLE-Verifi上得分54.9%。在需要高级分析与报告的专业领域,3.8 Flash在Vals Finance Agent V2和Harvey法律智能体基准(Harvey's Legal Agent Benchmark)上也超越了3.7 Flash和其他前沿模型。谷歌将这种提升归结于一个核心设计选择:3.8 Flash'更努力地工作'——面对复杂任务时它会执行更多推理步骤、迭代调用工具,在更高努力档位下甚至愿意消耗更多token来换取性能上限。博客还展示了几个颇具说服力的演示:仅用一句提示词就在Google Antigravity中构建出一款可完整游玩的DOS版谷歌地图,以及利用美国地质调查局真实数据生成的名胜地形图交互可视化。

另一个重头戏是Gemini 3.8 Flash Cyber——谷歌迄今最强的网络安全模型。它通过全新的Fairwind计划提供给可信的政府机构、关键基础设施运营者与软件维护者,拥有前沿水平的漏洞发现与自动修复能力。在衡量自主漏洞挖掘的标准行业基准CyberGym上,3.8 Flash Cyber同时超越了3.5 Flash Cyber以及规模大得多的前沿模型;在覆盖20种编程语言复杂代码库的内部综合基准上,也较前代模型实现了跨越式进步。谷歌特别强调,他们从一开始就把资源投向'漏洞修复'而非'漏洞利用'这类进攻性能力——在Collinear运营的CWE-Bench(业界公认的补丁能力外部基准)上,3.8 Flash Cyber以47.2%的pass@1站上帕累托前沿,仅略低于某领先前沿模型的47.8%,但成本显著更低。也就是说,防御者能用Flash级的价格获得接近顶级模型的修复能力。

最能说明问题的是谷歌'吃自己的狗粮'的实际战果。Chrome安全团队发现,3.8 Flash Cyber为Chrome漏洞生成正确补丁的数量,是那些规模大得多的最佳商业模型的2.6倍;云安全公司Wiz的内部渗透测试基准显示,3.8 Flash Cyber的召回率比其它领先前沿模型高出7.5到9.7个百分点,而成本仅为后者的约1/2.3到1/5.2;谷歌云漏洞研究团队更用它不到两小时就发现了一个关键基础漏洞——这类漏洞的研究与发现通常需要数月。安全设计上,3.8 Flash按谷歌前沿安全框架对CBRN(化生放核)与网络攻击等滥用域做了防护,而3.8 Flash Cyber为网络安全设置了更宽松的缓解策略,因此仅限需要全面网络能力的可信防御者;同时据Gray Swan测试,3.8系列在提示注入鲁棒性上也取得大幅进步。消费端方面,3.8 Flash已向Google AI Pro与Ultra订阅用户开放,覆盖Gemini应用、Google搜索的AI Mode以及Google Sheets中的Gemini。

对开发者、企业与普通用户来说,这次发布释放了几个明确信号。第一,'六周三个Flash'的高频迭代说明谷歌已把Flash系列当作与对手打消耗战的主武器——每次小幅涨价窗口都被刻意压后,用'同价更强'不断抬高性价比基准。第二,Cyber变体走的是与Anthropic Mythos类似的'同模型分层'路线:把最强能力封装进专门程序(Fairwind),面向可信防御者开放,既回应了安全监管关切,又为谷歌的安全产品生态埋下伏笔。第三,Chrome、Wiz与云漏洞研究团队的实测数据表明,这类模型已从'实验室基准好看'进化到'真实攻防可用',网络安全行业的人效比正在被重新定义。接下来值得关注的是:Fairwind计划会向哪些机构开放、3.8 Flash在真实长跑编码项目中的稳定性,以及OpenAI的GPT-5.x系列将如何回应这一轮价格与能力的双重竞争。

📌 来源:谷歌官方博客(2026年9月2日)《Introducing Gemini 3.8 Flash and 3.8 Flash Cyber》(https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/)。所有数据、基准得分与表述均基于该官方文章。

🤔 常见问题解答

Q1: Gemini 3.8 Flash与3.7 Flash有什么区别?

3.8 Flash是谷歌'迄今最好的推理与编码模型',在软件工程(DeepSWE v1.1超越多数更大前沿模型)、智能体任务与专业多步推理(HLE-Verifi 54.9%、Vals Finance Agent V2、Harvey法律基准)上较3.7 Flash显著提升,同时保持相同的速度与入门价格。3.7 Flash仍获全面支持,适合效率优先的工作负载。

Q2: Gemini 3.8系列的价格是多少?

3.8 Flash与3.7 Flash同价:入门价输入每百万token 0.75美元、输出每百万token 3.75美元,促销到2026年12月31日截止;2027年1月1日起调整为输入1.50美元、输出7.50美元每百万token。可通过Gemini API、AI Studio、Android Studio等渠道使用。

Q3: 谁能使用Gemini 3.8 Flash Cyber?

3.8 Flash Cyber仅通过Fairwind计划向可信防御者提供,包括受信任的政府机构、关键基础设施运营者与软件维护者。因为它具备更全面的网络安全能力(缓解策略更宽松),谷歌对申请者进行审核,不会向普通开发者或公众开放。

Q4: 普通用户现在怎么用上3.8 Flash?

开发者可通过Gemini API(AI Studio、Android Studio)或Google Antigravity等智能体优先工具使用,企业用户可在Gemini Enterprise中访问;个人用户方面,3.8 Flash已向Google AI Pro与Ultra订阅用户开放,覆盖Gemini应用、Google搜索AI Mode和Google Sheets中的Gemini。

🛠️ 推荐工具

  • 文本摘要工具 - 快速提炼谷歌官方发布与基准测试长文的核心要点,第一时间掌握模型能力变化
  • JSON格式化工具 - 整理与分析API定价、模型参数等JSON数据,让技术信息一目了然
  • 时间戳转换工具 - 换算新闻中的时间节点与促销截止日期(如2027年1月1日调价),规划API预算更直观

把这次发布放进更长的时间线里看,Gemini 3.8 Flash的意义远超'又一款新模型'。它证明了低价走量产品线同样可以承载前沿能力:DeepSWE v1.1上超越多数更大前沿模型、CWE-Bench上以47.2%的pass@1站上帕累托前沿,而价格却锚定在每百万token不足一美元的档位——'能力普及'与'成本控制'不再是非此即彼的单选题。对开发者而言,这意味着可以用Flash的价格去尝试过去只有旗舰模型才能胜任的长程编码与智能体任务;对安全行业而言,3.8 Flash Cyber在Chrome、Wiz与谷歌云漏洞研究团队手中的实战数据,预示着一场由AI驱动的防御效率革命正在发生。当然,高频迭代背后的可靠性、Fairwind的准入门槛、以及对OpenAI等对手的连锁反应,都还需要时间给出答案。但有一点已经很清楚:谷歌正在用'六周一更'的节奏,把Flash系列打造成AI竞争中最锋利的那把快刀。

总结

2026年9月2日,谷歌发布Gemini 3.8 Flash与Gemini 3.8 Flash Cyber——六周内的第三个Flash版本。3.8 Flash是最新最强的工作主力模型:在DeepSWE v1.1长程软件工程基准上超越多数更大的前沿模型,HLE-Verifi得分54.9%,在Vals Finance Agent V2与Harvey法律基准上超越前代,入门价保持与3.7 Flash相同(每百万token输入0.75/输出3.75美元,2027年1月1日起调至1.50/7.50美元)。3.8 Flash Cyber通过Fairwind计划向可信防御者开放:在CyberGym上超越3.5 Flash Cyber与更大前沿模型,CWE-Bench漏洞修复pass@1达47.2%(领先前沿模型47.8%,成本显著更低);Chrome安全团队实测其正确补丁数是更大商业模型的2.6倍,Wiz测得召回率提升7.5-9.7个百分点且成本仅为1/2.3到1/5.2,谷歌云漏洞研究团队用它不到2小时发现通常需数月才能找到的关键漏洞。安全上,3.8 Flash按前沿安全框架防护CBRN与网络攻击滥用,3.8 Flash Cyber因缓解策略更宽松而仅限可信防御者;提示注入鲁棒性据Gray Swan测试大幅提升。消费端已向Google AI Pro/Ultra用户开放(Gemini应用、AI Mode、Sheets)。这次发布标志着谷歌以'六周一更、同价更强'的策略,把低价Flash产品线推向前沿能力与真实安全应用的新高度。