谷歌发布Gemini 3.8 Live双版本:重新定义实时语音交互标准
2026-09-25 12:04:44未知 作者:徽声在线
北京时间9月16日消息,谷歌在最新技术发布会上正式推出两款革命性实时对话AI模型——Gemini 3.8 Live及其增强版Gemini 3.8 Live Extended Thinking。此次升级聚焦三大核心能力:多模态语音交互、动态推理响应及复杂任务自动化处理,标志着实时对话系统进入全新发展阶段。
据官方技术文档披露,Gemini 3.8 Live实现三大突破性功能:支持毫秒级视觉场景理解,可在对话过程中实时解析摄像头画面;内置多语言自动切换引擎,覆盖全球97种语言的无缝切换;创新引入后台任务执行机制,允许模型在保持对话连续性的同时调用第三方API完成数据查询、订单处理等操作。增强版则在此基础上增加渐进式思考功能,通过思维链技术将复杂任务拆解为可解释的步骤,并支持语音交互过程中的动态修正。
开发者生态方面,两款模型已同步开放Gemini API和Google AI Studio接入权限。消费级应用层面,Gemini 3.8 Live率先登陆Search Live搜索平台,用户可通过语音指令直接获取实时搜索结果;增强版则作为高级功能向Gemini Live订阅用户开放,首批支持金融分析、医疗咨询等12个专业领域的复杂任务处理。
