谷歌发布 Gemini 3.8 Flash,性能更强
The Verge AI··作者 Stevie Bonifield
关键信息
谷歌表示,Gemini 3.8 Flash 在 DeepSWE v1.1、Vals Finance Agent V2 和 Harvey 法律智能体基准上都超过了前代模型和其他前沿模型。该模型还针对化学、生物、放射和核武器以及网络攻击领域加入了滥用防护,而 Flash Cyber 版本和 Fairwind 计划则只面向政府和可信合作伙伴开放。
资讯摘要
谷歌发布了 Gemini 3.8 Flash,并将其描述为目前最强的 Flash 模型,重点面向推理、编程和智能体任务。公司表示,这一模型在软件工程和自主 AI 智能体方面有显著提升。谷歌称,它在 DeepSWE v1.1 软件工程基准上超过了前代模型和其他前沿模型,其中包括 Anthropic 的 Fable 5。它还被称在 Vals Finance Agent V2 和 Harvey Legal Agent 基准上优于竞争对手。除了主模型之外,谷歌还推出了 Gemini 3.8 Flash Cyber,这是一个针对漏洞检测与缓解优化的变体。
谷歌表示,新模型内置了针对化学、生物、放射和核武器以及网络攻击领域滥用的防护措施。与此同时,谷歌推出了 Fairwind 计划,该计划只向政府和可信合作伙伴开放,并提供 3.8 Flash Cyber 和 CodeMender 智能体的访问权限。谷歌称,CodeMender 可以自主发现并修复漏洞,帮助保护关键基础设施、公共服务和国家安全。对于普通用户,Gemini 3.8 Flash 已向 Google AI Pro 和 Ultra 订阅用户开放,也面向开发者和企业用户提供。尽管谷歌强调其定价具有吸引力,但文章也暗示,这款模型后续的实际使用成本可能会更高。

资讯正文
[媒体:https://twitter.com/ArtificialAnlys/status/2095177422270607803?s=20]
Aigora.ai 首席执行官 John Ennis 将 Gemini 3.8 Flash 与 Anthropic 的模型进行了比较,称它提供“Opus 5 级别的编码质量,但成本只有一小部分,而且速度超快”,并补充说,“对于制作 remotion 视频之类的事情来说,这会非常棒。”
[媒体:https://twitter.com/johnennis/status/2095182837112508749?s=20]
Google 表示,Gemini 3.8 Flash 在软件工程和自主 AI 代理方面带来了“显著改进”。在 DeepSWE v1.1 软件工程基准测试中,它的表现超过了前代产品和其他前沿模型,其中包括 Anthropic 的 Fable 5。后者本周早些时候也获得了升级,并承诺以更低的价格提供更强性能,方法是降低缓存数据的使用价格。
Google 的新模型在 Vals Finance Agent V2 基准测试和 Harvey 的 Legal Agent 基准测试中也击败了竞争对手。不过,这款新模型同样“内置了针对化学、生物、辐射和核武器(CBRN)以及网络攻击滥用的防护措施。”
来源与参考
收录于 2026-09-03