Google 最新的语音模型 Gemini 3.8 Live 与 Extended Thinking 大幅增强了实时语音对话能力,即使 AI 在处理复杂任务时,也能保持对话流程不中断。
想象一下:清晨醒来,你对智能手机说:“今天会议很多,帮我在午餐时间预约一家最近的餐厅。”以前的 AI 助手在搜索和预约时,往往会停顿,甚至不得不中断对话。但现在,世界正在发生改变,AI 可以像身边的得力助手一样回复:“我正在查找餐厅。有几个地方不错,我们要预约在 12 点 30 分吗?”对话流畅自然,毫无卡顿。
Google 最近发布的“Gemini 3.8 Live”和“Gemini 3.8 Live Extended Thinking”正是将这种未来愿景变为现实的尖端语音对话模型出处 1 出处 4。
这为何重要?
过去我们使用的许多语音 AI,在提问后会因为处理数据和生成回答而让对话出现“静止”感。就像厨师在准备食物时,厨房里完全没有声音,直到菜肴完成才再次出现。
但此次发布的模型是专为“实时语音代理”设计的出处 3。在用户与 AI 对话的同时,AI 可以自行执行复杂的任务,并向用户反馈处理情况,从而保证对话上下文的连贯性出处 1。这意味着用户可以与 AI 进行更自然、更深度的协作。
易懂的比喻
为了理解这项技术,我们举两个例子:
第一,“边思考边交谈”:‘Gemini 3.8 Live Extended Thinking’模型类似于我们在苦恼时自言自语。当 AI 处理复杂请求时,它会通过语音告诉用户进展,例如“我正在查看相关数据”或“处理这些信息需要一点时间”出处 8。这样用户就能明白 AI 并没有放弃请求,而是在努力工作。
第二,“拥有眼耳的魔法师”:这些模型不仅能听声音,它们还是能够同时理解语音、图像、视频和文本的“多模态”AI出处 2。就像一个拥有视听能力的专家,能够综合判断情况并参与对话。这得益于其一次性能记忆并分析高达 128K(约 12.8 万个)token 的海量信息出处 2。
当前状况
目前,Google 的这些模型已展现出惊人的成果。据机构“Artificial Analysis”的评估,‘Gemini 3.8 Live Extended Thinking’模型在“语音对话质量指数(Speech-to-Speech Quality Index)”中位居综合第一出处 10。它以 82.6 的高分证明了其业界领先的性能出处 7 出处 12。
此外,由于支持全球 97 种以上的语言,无论是韩语使用者还是其他语言的用户,都能更方便地与 AI 助手沟通出处 11 出处 15。您可以立即通过 Gemini App 或 Google AI Studio 亲自体验这项技术出处 8。
未来展望
Google 在过去几个月里几乎每三周就更新一次主要的 Gemini 模型,行动十分迅速出处 5。这展示了 AI 融入我们日常设备的脚步是多么快捷。
未来,AI 助手将不再仅仅是指令传输工具,而是成为我们在工作或思考时,能够与我们一起思考、提供建议的真正“伙伴”。此次更新是 AI 对话跨越纯技术沟通,向更亲近人类交互方向迈出的重要里程碑。
MindTickleBytes AI 记者观点
人类的对话不仅仅是信息的交换,更是‘思维流’的共享过程。此次推出的模型使 AI 更进一步,能够在不打断人类思维流的情况下,与其共同思考。
参考资料
- Gemini 3.8 Live & Gemini 3.8 Live Extended Thinking - The Keyword
- Gemini 3.8 Audio (Live, Live Extended Thinking) - Model Card
- Google Releases Gemini 3.8 Live and 3.8 Live Extended Thinking for Production-Grade Voice Agents
- Gemini 3.8 Live Extended Thinking powers Gemini Live, Gmail
- Gemini 3.8 Live & Extended Thinking: Google Voice AI [2026]
- Gemini 3.8 Live Launch: 82.6 Voice AI Score [2026]
- Meet Gemini 3.8 Live and 3.8 Live Extended Thinking: our best…
- 「Gemini 3.8 Live/3.8 Live Extended Thinking」正式発表 – Jetstream
-
[Gemini 3.8 Live и 3.8 Live Extended Thinking… AiManual](https://ai-manual.ru/article/gemini-38-live-i-38-live-extended-thinking-golosovyie-ai-agentyi-s-parallelnyim-myishleniem/) - Google DeepMind выпустила Gemini 3.8 Live и Extended Thinking…
- Gemini 3.8 Live: Google Splits Its Voice Line in Two
- Gemini 3.8 Live Extended Thinking Pricing, Specs & Sources
- Google launches Gemini 3.8 Live to take on OpenAI’s GPT-Live-1 at…
- 只能识别图像
- 在进行任务时通过语音说明进展,从而保持对话流畅
- 只能通过文本对话
- 仅限语音数据
- 仅限文本
- 语音、图像、视频和文本
- 70.5分
- 82.6分
- 90.0分