
Gemini 3.1 Flash Live 音频与语音模型正式上线,进一步突破了 Gemini 系列的「实时对话」能力。它拥有下一代「语音优先 AI」所需的响应速度与自然对话节奏,为开发者、企业及大众用户,带来了更直观、更流畅的交互体验。
3.1 Flash Live 现已全面接入 Google 产品矩阵。
开发者视角:强悍的推理与任务执行能力
Google 对 3.1 Flash Live 的综合能力进行了全面升级,它是开发者与企业搭建大规模、可执行复杂任务 AI 智能体的可靠基石。
- 在专门考察多重约束条件下多步函数调用能力的 ComplexFuncBench Audio 基准测试中,新模型以 90.8% 的高分领跑,成绩远超前代模型。


- 在 Scale AI 发布的 Audio MultiChallenge 评测中,开启「思考」模式后的 Gemini 3.1 Flash Live,以 36.1% 的成绩位居榜首。这项基准测试的考核标准尤为严苛,专门考察模型在真实音频环境(如频繁打断、语气犹豫)下的复杂指令遵循与长程推理能力。

为了让对话更有人情味,3.1 Flash Live 大幅优化了对语气的感知和理解能力。在 Gemini Enterprise for Customer Experience 场景中,它对音高、语速等声学细节的捕捉能力,相比上一代 2.5 Flash Native Audio 更加敏锐。当察觉到用户流露出沮丧或困惑的情绪时,它甚至能动态调整回复的策略与语气。
大众体验:更自然、直观的交互方式
无论是日常的快速提问,还是深入的话题探讨,3.1 Flash Live 都能在 Gemini Live 和 Search Live 中,为用户提供更实用、更自然的交互反馈。
- 在 3.1 Flash Live 强大引擎的驱动下,Gemini Live 不仅响应速度远超前代,上下文记忆长度也直接翻了一倍。即便是长时间的头脑风暴,它也能牢牢紧跟你的思路,不会打断灵感的延续。
- 3.1 Flash Live 原生具备强大的多语言能力,覆盖 200 多个国家和地区。全球用户都可以用自己最熟悉的语言,对搜索引擎展开实时的多模态对话。
立即体验 Gemini 3.1 Flash Live
- 开发者预览:Gemini Live API 和 Google AI Studio。
- 企业用户:Gemini Enterprise for Customer Experience
- 个人用户:Search Live 和 Gemini Live。
3.1 Flash Live 生成的所有音频都嵌入了 SynthID 技术。「隐形水印」会直接交织在音频输出的底层逻辑中,人耳无法察觉,但能实现对 AI 生成内容的精准检测,有效防范虚假信息传播。
















最新评论
有多亮,是blingbling的吗🤣
这个网站眼前一亮
不要装,千万不要装,无法自定义鼠标指针,主题和壁纸需要重新设置,但是鼠标指针完全被像素版大白指针替代,无法更改。
鼠标指针也没了qwq