Gemini3.8Live 升级语音智能:对话、推理与任务执行进一步融合
周四
谷歌发布 Gemini3.8Live 和 Gemini3.8Live Extended Thinking 两款模型,新增近实时推理、语音与思考同步处理及后台工具和 API 调用等核心能力,支持 97 种语言自动检测及切换、近实时视觉定位,还会以语言提示告知用户思考状态。两款模型已登陆相关开发者平台并覆盖多场景,在多项测试中取得较好成绩,谷歌已与多平台合作方便开发者集成,且模型生成的音频均嵌入 SynthID 水印。此次升级将实时语音交互从「听与说」扩展至理解、推理和任务执行,推动语音 AI 向持续、多任务的智能体交互形态发展。
Gemini3.8Live 升级语音智能:对话、推理与任务执行进一步融合
maomu.com/aibase
Gemini 3.8 Live 系列发布,语音 Agent 在多维度评测中表现如何?
ITBear 科技资讯
体验专业版特色功能,拓展更丰富、更全面的相关内容。