Google DeepMind Blog

Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber

8.5内容质量

TL;DR · AI 摘要

Google推出Gemini 3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber,提升AI代理效率和性能。

核心要点

  • 6 Flash减少17%输出令牌,成本降低30%。
  • 5 Flash-Lite每秒输出350令牌,性能提升40%。
  • 5 Flash Cyber结合CodeMender实现网络安全应用。

结构提纲

按章节快速跳转。

  1. 介绍Gemini系列新模型的发布背景与目标。

  2. 通过减少令牌使用和成本优化提升效率。

  3. 以更低的成本实现更高的输出速度。

  4. 专为网络安全场景设计的模型组合。

思维导图

用一张图看清主题之间的关系。

查看大纲文本(无障碍 / 无 JS 友好)
  • Gemini新模型发布
    • 3.6 Flash
      • 17%令牌效率提升
      • 成本降低30%
    • 3.5 Flash-Lite
      • 350令牌/秒
      • 40%成本优化
    • 3.5 Flash Cyber
      • 网络安全专用
      • CodeMender集成

金句 / Highlights

值得收藏与分享的关键句。

#Gemini#AI模型#DeepMind#机器学习
打开原文

3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber

介绍 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber

2026年7月21日

|

分享下拉菜单

  • x.com
  • Facebook
  • LinkedIn
  • 邮件
  • 复制链接

我们最新推出的 Gemini 模型能够提供更高的效率、更低的延迟和更可靠的性能,从而实现大规模构建 AI 代理。

Tulsee Doshi

产品管理高级总监,代表 Gemini 团队

分享

文章正文

开发人员和客户在构建生产级 AI 代理时需要更高的令牌效率、更低的延迟和更可靠的性能。我们的 Flash 系列模型旨在平衡效率和质量,以实现代理工作流程的扩展。基于 Gemini 3.5 Flash,我们推出了以下新模型:

  • 3.6 Flash:我们的主力模型,在编码、知识工作和多模态性能方面表现更优。根据《人工分析指数》,与 3.5 Flash 相比,3.6 Flash 的输出令牌使用量减少了 17%,在某些基准测试(如 Datacurve 的 DeepSWE)中,我们观察到减少幅度高达 65%,且每输出令牌成本更低。
  • 3.5 Flash-Lite:我们最快的、性价比最高的 3.5 级模型,根据《人工分析指数》,每秒可输出 350 个令牌,同时在代理工作流程中显著优于之前的 Flash-Lite 一代。
  • CodeMender 中的 3.5 Flash Cyber:成功的网络安全应用需要将模型与代理基础设施进行精细的编排。我们推出了一种新的、高效且专注于网络安全的专用模型,与我们的 CodeMender 代码安全代理相结合,在前沿领域实现了具有竞争力的性能。

除了今天发布的模型,Gemini 3.5 Pro 目前正在与合作伙伴进行测试,我们计划在准备好后尽快广泛推出。同时,我们的团队已经开始专注于构建下一代模型。我们已经开始进行 Gemini 4 的最雄心勃勃的预训练运行,并对取得的进展感到兴奋。

3.6 Flash:比 3.5 Flash 更高效、质量更优

Gemini 3.6 Flash 直接基于 3.5 Flash 的开发者和客户反馈进行改进。3.6 Flash 不仅在编码和知识工作方面有所提升,同时显著提高了令牌效率。例如,在《人工分析指数》中,我们看到 3.6 Flash 相比 3.5 Flash 的输出令牌消耗减少了 17%。它完成多步骤工作流程所需的推理步骤和工具调用也更少。

这种增强的效率还伴随着比 3.5 Flash 更低的价格。以每百万输入令牌 1.50 美元和每百万输出令牌 7.50 美元的价格,3.6 Flash 降低了每项代理任务的整体成本,使代理的构建和运行更具成本效益。

在 OSWorld 验证任务(API)中,3.6 Flash 展示了比 3.5 Flash 更好的令牌效率和更少的冗余输出

即使在效率更高的情况下,3.6 Flash 在各种用例中相比 3.5 Flash 也实现了性能提升:

  • 3.6 Flash 在 DeepSWE(49% vs. 37%)中表现出更高的精度,不想要的代码编辑更少,执行循环更少,并在 MLE Bench(63.9% vs. 49.7%)中显示出显著的机器学习研究改进。
  • 它在 OSWorld-Verified(83.0% vs. 78.4%)中展示了改进的计算机使用能力。现在,计算机使用是通过 Gemini API 和 Gemini Enterprise 的客户端工具内置的。
  • 在知识密集型任务中,其表现优于3.5 Flash,基准测试GDPval-AA v2(1421 vs. 1349)证明了这一点。Hebbia和Harvey等客户发现,它在文档解析、图表数据分析和报告起草等多模态任务中表现出色。

3.6 Flash通过在AIS上使用托管代理,可比3.5 Flash(AIS)更高效准确地解析和分析财务数据及转录文本。

3.6 Flash在AGY上使用多代理编排执行代码迁移,相比3.5 Flash(AGY)具有更低的延迟和更高的质量。

3.6 Flash利用画布(Gemini App)为3D工作流开发了摄影纹理提取器。

3.6 Flash结合AGY和tldraw离线编辑器,凭借强大的视觉理解能力构建了交互式主题工作室(AGY)。

客户报告称,3.6 Flash在成本和质量方面都有显著提升,在复杂工作流和知识密集型任务中实现了令牌效率、准确性和速度的平衡:

安全构建

3.6 Flash在化学、生物、放射和核(CBRN)以及网络攻击滥用领域新增了增强型前沿安全防护措施。这些防护使模型对越狱攻击的抵抗力显著提升。同时,模型经过训练以减少对有益用途的拒绝响应。

更多信息请参见3.6 Flash模型卡片。

3.5 Flash-Lite:专为扩展代理工作流而设计

除Flash系列外,我们还推出Gemini 3.5 Flash-Lite,专为低延迟任务和对开发者工作流至关重要的高吞吐量任务设计,如代理搜索和文档处理。

3.5 Flash-Lite是3.5系列中最快的模型。根据人工分析数据,其输出速率达350个令牌/秒。定价为每百万输入令牌0.3美元、每百万输出令牌2.5美元,且质量显著优于3.1 Flash-Lite。对于需要处理高吞吐量生产流量的开发者和客户,3.5 Flash-Lite提供了出色的性价比。

3.5 Flash-Lite在处理高容量任务时的延迟低于3.5 Flash。

3.5 Flash-Lite能够高效扩展代理系统。在不同思考层级上,该模型显著优于3.1 Flash-Lite。根据工作负载,开发者可配置模型优先以低延迟、低成本执行高容量任务(使用最小和低级思考层级),或通过高级思考层级处理多步骤子代理工作负载。该模型现在还内置了计算机使用工具,可靠支持跨平台的代理任务。

在Terminal-Bench 2.1(54% vs 31%)、GDM-MRCR v2(72.2% vs. 60.1%)和GDPval-AA v2(1140 vs. 642)等基准测试中,其在编码和代理任务上的表现显著提升。

事实上,在许多代理和编码评估中,3.5 Flash-Lite甚至优于3 Flash,包括在SWE-Bench Pro(54.2% vs. 49.6%)和OSWorld-Verified(74.0% vs. 65.1%)等测试中,使其成为处理2.5和3 Flash工作负载的更快、更强大选项。

3.5 Flash-Lite从海量电商数据集中提取产品特征并进行合成。

作为主代理与3.6 Flash协同工作时,3.5 Flash-Lite可即时生成25个独特、可供探索的网页设计概念。

3.5 Flash-Lite凭借多模态理解能力,可扩展收据翻译和摘要功能。

3.5 Flash-Lite通过即时生成和迭代多个选项来构建游戏。

3.5 Flash-Lite 的早期用户强调了其在扩展智能工作流和数据处理任务方面的独特优势,将速度、智能性和成本效率完美结合:

有关该模型的更多信息,请参阅 3.5 Flash-Lite 模型卡片。

3.5 Flash Cyber 在 CodeMender 中的应用:高效发现和修复漏洞

AI 模型已经能够比当前系统修复漏洞的速度更快地发现安全漏洞。应对这一日益增长的威胁,需要一种高度高效且强大的软件安全方法。

Flash 的性能和效率使其成为大规模检测、验证和修补代码安全问题的理想基础。Gemini 3.5 Flash Cyber 基于 3.5 Flash 构建,并针对以低于大模型每 token 成本的价格发现和修复网络安全漏洞进行了微调。

在 CodeMender 中,多个 3.5 Flash Cyber 代理协同工作生成单一综合报告,3.5 Flash Cyber 在流行基准测试 CyberGym 上达到了前沿的竞争力水平。

鉴于该技术的双重用途性质,我们对部署 3.5 Flash Cyber 采取了审慎的策略。该模型将通过 CodeMender 仅向政府和可信合作伙伴提供,作为有限访问试点计划的一部分。这将使一线防御者在漏洞被利用之前获得发现和修复关键漏洞的先发优势,同时减少更广泛的滥用风险。

3.6 Flash 和 3.5 Flash-Lite:立即开始使用

3.6 Flash 和 3.5 Flash-Lite 今日起正式发布:

  • 开发者可通过 Google AI Studio 和 Android Studio 的 Gemini API 使用。3.6 Flash 也可在 Google Antigravity 上使用。请通过《开发者指南》开始使用。
  • 企业用户可通过 Gemini 企业代理平台使用。3.6 Flash 也可在 Gemini 企业应用中使用。
  • 所有用户均可通过 Gemini 应用使用。3.5 Flash-Lite 也将逐步在 Google 搜索中上线。

在您开始使用 3.6 Flash 和 3.5 Flash-Lite 进行开发时,我们欢迎您提供反馈,以改进未来的 Gemini 模型,并期待尽快发布 3.5 Pro 版本。

在您的收件箱中获取 Google 最新资讯

订阅我们的新闻通讯,获取产品更新、活动信息、特别优惠等资讯。

订阅成功。只需再完成一步。

检查您的收件箱以确认订阅。

您也可以使用其他电子邮件地址进行订阅。

您的信息将按照 Google 的隐私政策使用。您可随时选择退出。