2026年9月17日更新
今天,我们推出两款新模型,将近实时推理能力推向新高度,从而更有效地赋能语音智能体,让人工智能对话体验更加直观、智能。
Gemini 3.8 Live:专为大规模部署和成本效率而设计,融合对话智能、流畅对话与视觉 grounding 技术。
Gemini 3.8 Live Extended Thinking:面向高复杂度任务构建,具备更强的智能水平与多步推理能力。
对于开发者和企业而言,这些模型提供了构建可靠、可投入生产环境的语音智能体的核心模块。同时,它们也让通过 Gemini App、Google Workspace 和 Google Search 与 Gemini 进行语音交互更加流畅且富有协作性——助你仅凭语音即可应对复杂任务。
体验更流畅、更智能的对话
Gemini 3.8 Live Extended Thinking 提供企业级任务完成能力与智能水平,在 Artificial Analysis 的“语音到语音质量指数”(Speech to Speech Quality Index)中位居榜首(得分82.6),并在代理式任务完成方面表现领先:在 τ-Voice 基准测试中达到68.6%,在 Sierra 的 τ-Voice-banking 基准测试中达到35.1%。它还展现出强大的推理能力,在 Big Bench Audio 上取得97.7%的高分,同时与其他前沿模型相比保持了极具竞争力的价格定位。
Gemini 3.8 Live 获得了用户的高度青睐,在 Speech Agent Arena 中位列第二。除卓越性能外,它依然具备极高的成本效益——为开发者和企业提供了一款能力强、效率高且专为大规模应用而设计的模型。