谷歌发布 Gemini 3.8 Flash,性能更强

The Verge AI··作者 Stevie Bonifield

关键信息

谷歌表示,Gemini 3.8 Flash 在 DeepSWE v1.1、Vals Finance Agent V2 和 Harvey 法律智能体基准上都超过了前代模型和其他前沿模型。该模型还针对化学、生物、放射和核武器以及网络攻击领域加入了滥用防护,而 Flash Cyber 版本和 Fairwind 计划则只面向政府和可信合作伙伴开放。

资讯摘要

谷歌发布了 Gemini 3.8 Flash,并将其描述为目前最强的 Flash 模型,重点面向推理、编程和智能体任务。公司表示,这一模型在软件工程和自主 AI 智能体方面有显著提升。谷歌称,它在 DeepSWE v1.1 软件工程基准上超过了前代模型和其他前沿模型,其中包括 Anthropic 的 Fable 5。它还被称在 Vals Finance Agent V2 和 Harvey Legal Agent 基准上优于竞争对手。除了主模型之外,谷歌还推出了 Gemini 3.8 Flash Cyber,这是一个针对漏洞检测与缓解优化的变体。

谷歌表示,新模型内置了针对化学、生物、放射和核武器以及网络攻击领域滥用的防护措施。与此同时,谷歌推出了 Fairwind 计划,该计划只向政府和可信合作伙伴开放,并提供 3.8 Flash Cyber 和 CodeMender 智能体的访问权限。谷歌称,CodeMender 可以自主发现并修复漏洞,帮助保护关键基础设施、公共服务和国家安全。对于普通用户,Gemini 3.8 Flash 已向 Google AI Pro 和 Ultra 订阅用户开放,也面向开发者和企业用户提供。尽管谷歌强调其定价具有吸引力,但文章也暗示,这款模型后续的实际使用成本可能会更高。

谷歌发布 Gemini 3.8 Flash,性能更强

资讯正文

[媒体:https://twitter.com/ArtificialAnlys/status/2095177422270607803?s=20]

Aigora.ai 首席执行官 John Ennis 将 Gemini 3.8 Flash 与 Anthropic 的模型进行了比较,称它提供“Opus 5 级别的编码质量,但成本只有一小部分,而且速度超快”,并补充说,“对于制作 remotion 视频之类的事情来说,这会非常棒。”

[媒体:https://twitter.com/johnennis/status/2095182837112508749?s=20]

Google 表示,Gemini 3.8 Flash 在软件工程和自主 AI 代理方面带来了“显著改进”。在 DeepSWE v1.1 软件工程基准测试中,它的表现超过了前代产品和其他前沿模型,其中包括 Anthropic 的 Fable 5。后者本周早些时候也获得了升级,并承诺以更低的价格提供更强性能,方法是降低缓存数据的使用价格。

Google 的新模型在 Vals Finance Agent V2 基准测试和 Harvey 的 Legal Agent 基准测试中也击败了竞争对手。不过,这款新模型同样“内置了针对化学、生物、辐射和核武器(CBRN)以及网络攻击滥用的防护措施。”

来源与参考

  1. 原始链接
  2. Google says its new Gemini 3.8 Flash model ‘works harder’ but might cost more
  3. Google releases Gemini 3.8 Flash, its third Flash model in six weeks

收录于 2026-09-03