介绍 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber

发布于

我们最新的 Gemini 模型提供了构建大规模 AI 代理所需的效率、延迟和可靠性。

---

[Tulsee Doshi, 产品管理高级总监,代表 Gemini 团队](https://blog.google/authors/tulsee-doshi/)

![a hero image saying 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber](https://storage.googleapis.com/gweb-uniblog-publish-prod/images/gemini-3-5_3-6_3-5-Cyber__key-ar.width-2200.format-webp.webp)

对于开发者和客户而言,构建生产 AI 代理需要更高的 token 效率、更低的延迟以及更可靠的性能。我们全新的 Flash 系列模型旨在满足效率与质量的最佳结合,以支持代理工作流的扩展。在此基础上,我们推出了新的 Gemini 模型:

* **3.6 Flash:** 我们的主力模型,提供更好的编码、知识工作和多模态性能。根据 [人工分析指数](https://artificialanalysis.ai/models/gemini-3-6-flash),与 3.5 Flash 相比,它减少了 17% 的输出 token 使用,在某些基准测试(如 DeepSWE)中,使用 Datacurve 的数据观察到最高可达 65%,而且每个输出 token 的成本更低。
* **3.5 Flash-Lite:** 我们最快、性价比最高的 3.5 类模型,根据人工分析指数,能够以每秒 350 个输出 token 的速度运行,且在代理工作流中显著优于之前的 Flash-Lite 版本。
* **3.5 Flash Cyber in CodeMender:** 成功的网络安全应用需要在模型和代理基础设施之间进行精心的协调。我们推出了一种新型的高效、专注于网络安全的模型,并与我们的 CodeMender 代码安全代理结合,能够在这一领域提供具有竞争力的性能。

除了今天的发布,Gemini 3.5 Pro 正在与合作伙伴进行测试,我们计划在准备好后尽快广泛发布。同时,我们的团队已经开始专注于下一代模型的构建。我们启动了迄今为止最雄心勃勃的预训练运行,面向 Gemini 4,并对进展感到兴奋。

### 3.6 Flash:比 3.5 Flash 更高效,质量更好

Gemini 3.6 Flash 是直接基于开发者和客户对 3.5 Flash 的反馈而构建的。3.6 Flash 不仅在编码和知识工作方面实现了提升,还在 token 效率方面有了实质性的提升。例如,根据人工分析指数,3.6 Flash 使用的输出 token 比 3.5 Flash 少 17%。同时,它在完成多步骤工作流时所需的推理步骤和工具调用也更少。

这种提高的效率还伴随着比 3.5 Flash 更低的价格。3.6 Flash 的价格为 $1.50/1M 输入 tokens 和 $7.50/1M 输出 tokens,使得每个代理任务的总体成本降低,从而使构建和运行代理更加具有成本效益。

3.6 Flash 在多个用例中表现出比 3.5 Flash 更好的效率:

* 3.6 Flash 以更高的精度减少不必要的代码编辑和执行循环,在 DeepSWE 中表现为 49% 对 37%,并在机器学习研究中表现为 MLE Bench 的 63.9% 对 49.7%。
* 它在计算机使用能力方面有所改善,在 OSWorld 验证中达到了 83.0% 对 78.4%。计算机使用现在通过 Gemini API 和 Gemini 企业版提供作为内置客户端工具。
* 在知识工作上,3.6 Flash 超过 3.5 Flash,在 GDPval-AA v2 中表现为 1421 对 1349。像 Hebbia 和 Harvey 这样的客户发现它特别适合用于文档解析、图表和数据分析以及报告撰写等多模态任务。

客户报告称,3.6 Flash 在成本和质量上都有所进步,在复杂的工作流和知识密集型任务中实现了 token 效率、准确性和速度的平衡。

### 3.5 Flash-Lite:为代理工作流的扩展而构建

除了 Flash,我们还推出了 Gemini 3.5 Flash-Lite,旨在满足开发者工作流中低延迟任务和高吞吐量任务的需求,例如代理搜索和文档处理。

3.5 Flash-Lite 是 3.5 系列中最快的模型。根据 [人工分析](https://artificialanalysis.ai/models/gemini-3-5-flash-lite),其运行速度为每秒 350 个输出 tokens。其价格为 $0.3/1M 输入 tokens 和 $2.5/1M 输出 tokens,且与 3.1 Flash-Lite 相比,质量显著提高,为开发者和客户提供了良好的性价比,能够处理高吞吐率的生产流量。

3.5 Flash-Lite 在比 3.5 Flash 更低的延迟下执行大容量任务。在各个思维层次上,模型显著超越了 3.1 Flash-Lite。根据工作负载,开发者可以配置模型以优先处理低延迟、低成本的高容量任务,或在处理多步骤子代理工作负载时使用更高的思维层次。

3.5 Flash Cyber in CodeMender:高效查找和修复漏洞

AI 模型快速发现安全漏洞的能力超过了当前系统的修复速度。应对这种日益增加的威胁需要一种高度能力和高效的安全软件策略。Gemini 3.5 Flash Cyber 基于 3.5 Flash,经过细调,以便以低于大模型的 token 成本发现和修复网络安全漏洞。

3.6 Flash 和 3.5 Flash-Lite:今天就开始使用

3.6 Flash 和 3.5 Flash-Lite 从今天开始可用:

* 对于开发者,通过 [Google AI Studio](https://aistudio.google.com/prompts/new_chat?model=gemini-3.6-flash) 和 [Android Studio](https://developer.android.com/studio) 的 Gemini API 可用。3.6 Flash 还可以在 [Google Antigravity](https://antigravity.google/) 中使用。
* 对于企业通过 [Gemini 企业代理平台](https://console.cloud.google.com/agent-platform/studio/multimodal/)。3.6 Flash 还可以在 [Gemini 企业应用](https://cloud.google.com/gemini-enterprise?e=48754805) 中使用。
* 对于所有人通过 [Gemini 应用](http://gemini.google/)。3.5 Flash-Lite 也在 Google 搜索中推出。

在您开始使用 3.6 Flash 和 3.5 Flash-Lite 的同时,我们欢迎您的反馈,以改进未来的 Gemini 模型,并期待尽快发布 3.5 Pro。

---

原文链接:[点击查看](https://deepmind.google/blog/introducing-gemini-36-flash-35-flash-lite-and-35-flash-cyber/)

评论

暂无评论。