Introducing our most advanced Gemini Audio models yet 🗣 Gemini 3.8 Live and 3.8 Live Extended Thin...
TL;DR · AI 摘要
Google推出Gemini 3.8 Live和Extended Thinking音频模型,前者支持多语言实时交互,后者可处理复杂任务并行推理。
核心要点
- Gemini 3.8 Live支持97种语言实时切换并理解视觉上下文
- Extended Thinking版本可并行处理多步骤任务并实时叙述进展
- Search Live已集成音频模型实现DIY任务语音指导
结构提纲
按章节快速跳转。
- §模型发布
Google宣布推出新一代Gemini Audio模型,提升人机交互自然度
- ·核心机制
3.8 Live专注效率,Extended Thinking强化复杂任务处理能力
- ›应用场景
支持跨语言实时指导、视觉问题诊断等实际使用场景
- ·技术优势
Extended Thinking实现推理与对话并行处理的突破性能力
- ›产品集成
Search Live已应用音频模型提供分步语音操作指导
思维导图
用一张图看清主题之间的关系。
查看大纲文本(无障碍 / 无 JS 友好)
- Gemini Audio模型
- 3.8 Live
- 多语言支持
- 视觉上下文理解
- 成本效率优化
- Extended Thinking
- 并行推理
- 任务叙述
- 复杂项目处理
- 应用场景
- Search Live集成
- DIY指导
- 跨语言交互
金句 / Highlights
值得收藏与分享的关键句。
Gemini 3.8 Live Extended Thinking可处理多步骤项目且不中断对话流程
Search Live通过摄像头识别问题区域后提供音频修复指导
Extended Thinking版本实现推理与语音叙述的并行处理
Google AI on X: "Introducing our most advanced Gemini Audio models yet 🗣 Gemini 3.8 Live and 3.8 Live Extended Thinking let you speak, collaborate, and execute tasks seamlessly, meaning conversing with AI just got a lot more natural. So, what’s the difference between these two models? Let’s brea… / X
Google AI
@GoogleAI
我们推出了迄今为止最先进的Gemini Audio模型🗣 Gemini 3.8 Live和3.8 Live Extended Thinking让您能够自然地与AI对话、协作并执行任务。那么这两个模型之间有什么区别呢?让我们来详细说明: — Gemini 3.8 Live专为大规模应用、高速处理和成本效益而设计。它能够处理句子中途的打断,实时切换97种语言,并理解视觉上下文。只需在Search Live中用摄像头对准问题区域,即可通过分步语音指令解决自行车链条断裂或水管漏水等问题。 — Gemini 3.8 Live Extended Thinking在复杂任务处理上更进一步,通过并行推理和语音输出提升智能水平,甚至能边工作边叙述进度。这使其能够处理多步骤的幕后项目(如活动策划),而不会中断对话流程。观看Gemini 3.8 Live如何在Search Live中结合实时视频和语音输入,逐步完成动手类的DIY管道维修任务👇
$
00:00
/$
5:07 PM · Sep 15, 2026
·
239.8K
Views
178
313
3K
907 /