Gemini 3.1 Flash Live:让音频AI更加自然可信

发布于

**Gemini 3.1 Flash Live** 是谷歌最新的AI音频模型,旨在实现更加自然和可靠的实时对话。开发者可以通过谷歌AI工作室的 **Gemini Live API** 访问这一模型,企业则可以利用它提升客户体验。无论是搜索服务还是Gemini Live,全球超过200个国家的用户均可体验。

---

### 核心特点

- **Gemini 3.1 Flash Live** 让AI音频更自然、更可靠。
- 新模型速度更快,能更好地理解语调,实现自然对话。
- 开发者可基于此构建更复杂任务的语音代理,处理更高效。
- Gemini Live和Search Live现可提供更有帮助的多语言响应。
- 所有使用3.1 Flash Live生成的音频均带有水印,旨在防止错误信息的传播。

![Gemini 3.1 Flash Live](https://storage.googleapis.com/gweb-uniblog-publish-prod/images/gemini-3.1-flash-live_blog_heade.width-2200.format-webp.webp)

## 实际应用场景

3.1 Flash Live在速度和自然节奏上实现了新的突破,尤其适用于下一代以语音为主的AI,提供开发者、企业和日常用户更直观的体验。
- **对于开发者**:在[ComplexFuncBench Audio](https://github.com/zai-org/ComplexFuncBench?tab=readme-ov-file)基准测试中,3.1 Flash Live模型的得分达到了90.8%。
- **企业反馈**:像Verizon、LiveKit和The Home Depot等公司在工作流程中都对3.1 Flash Live作出了积极评价。

## 多语言支持

3.1 Flash Live本身具有多语言能力,使得本周搜索服务的全球扩展成为可能,用户在超过200个国家和地区均可使用自己的语言进行实时、多模态对话。

## 体验与安全

所有通过3.1 Flash Live生成的音频均通过**SynthID**水印处理,帮助可靠检测AI生成内容,从而维护信息的准确性和安全性。
直接体验3.1 Flash Live,感受它的自然和可靠性,期待看到大家如何互动和构建!

---

原文链接:[点击查看](https://deepmind.google/blog/gemini-3-1-flash-live-making-audio-ai-more-natural-and-reliable/)

评论

暂无评论。