Gemini 3.1 Flash-Lite:为大规模智能而生
今天,我们推出了Gemini 3.1 Flash-Lite,这是我们最快、最具成本效益的Gemini 3系列模型。该模型专为高容量开发者工作负载而设计,能够在价格和性能两个方面提供高质量的服务。
### 高效能与低成本
3.1 Flash-Lite的定价为每百万输入标记$0.25,每百万输出标记$1.50,相较于更大型模型而言,性价比高。根据[Artificial Analysis benchmark](https://artificialanalysis.ai/),它在首次响应令牌的速度上比2.5 Flash快2.5倍,并且输出速度提高了45%,同时保持了相似或更好的质量。这种低延迟非常适合高频工作流程,非常适合开发者构建快速、实时的应用体验。

### 尖端性能
3.1 Flash-Lite在[Arena.ai Leaderboard](http://arena.ai/leaderboard)上的Elo评分为1432,超越了同类模型在推理和多模态理解基准上的表现,包括GPQA Diamond的86.9%和MMMU Pro的76.8%。它的表现甚至超过了之前版本的较大Gemini模型,如2.5 Flash。

### 灵活适应的智能
除了卓越的性能,Gemini 3.1 Flash-Lite在AI Studio和Vertex AI中提供标准的思考级别,让开发者可以灵活选择模型在特定任务中的计算程度,这对处理高频工作负载至关重要。3.1 Flash-Lite能够在规模上处理诸如高容量翻译和内容审核等任务,同时也能够完成更复杂的工作负载,比如生成用户界面、创建模拟和跟随指令等。
这款模型已有多家企业,以及在AI Studio和Vertex AI上进行早期测试的开发者使用,反馈表明3.1 Flash-Lite在处理复杂输入时具备与更高级别模型相似的精度,同时能更好地遵循指令。
我们期待看到你们使用3.1 Flash-Lite及其它Gemini 3系列模型构建出什么样的应用!
---
原文链接:[点击查看](https://deepmind.google/blog/gemini-3-1-flash-lite-built-for-intelligence-at-scale/)
### 高效能与低成本
3.1 Flash-Lite的定价为每百万输入标记$0.25,每百万输出标记$1.50,相较于更大型模型而言,性价比高。根据[Artificial Analysis benchmark](https://artificialanalysis.ai/),它在首次响应令牌的速度上比2.5 Flash快2.5倍,并且输出速度提高了45%,同时保持了相似或更好的质量。这种低延迟非常适合高频工作流程,非常适合开发者构建快速、实时的应用体验。

### 尖端性能
3.1 Flash-Lite在[Arena.ai Leaderboard](http://arena.ai/leaderboard)上的Elo评分为1432,超越了同类模型在推理和多模态理解基准上的表现,包括GPQA Diamond的86.9%和MMMU Pro的76.8%。它的表现甚至超过了之前版本的较大Gemini模型,如2.5 Flash。

### 灵活适应的智能
除了卓越的性能,Gemini 3.1 Flash-Lite在AI Studio和Vertex AI中提供标准的思考级别,让开发者可以灵活选择模型在特定任务中的计算程度,这对处理高频工作负载至关重要。3.1 Flash-Lite能够在规模上处理诸如高容量翻译和内容审核等任务,同时也能够完成更复杂的工作负载,比如生成用户界面、创建模拟和跟随指令等。
这款模型已有多家企业,以及在AI Studio和Vertex AI上进行早期测试的开发者使用,反馈表明3.1 Flash-Lite在处理复杂输入时具备与更高级别模型相似的精度,同时能更好地遵循指令。
我们期待看到你们使用3.1 Flash-Lite及其它Gemini 3系列模型构建出什么样的应用!
---
原文链接:[点击查看](https://deepmind.google/blog/gemini-3-1-flash-lite-built-for-intelligence-at-scale/)
评论
暂无评论。