谷歌发布Gemini 3.8 Live与Extended Thinking,实时语音支持多步骤推理
边想边说的实时语音大模型: Google 发布 Gemini 3.8 Live 与 Extended Thinking 把实时语音推向多步骤推理 基础版本 Gemini 3.8 Live 专注于大...
谷歌新出的Gemini 3.8 Live和Extended Thinking,能一边说话一边思考,比如查资料时能同步汇报进度,比普通语音助手更智能。
谷歌推出的Gemini 3.8 Live基础版支持97种语言实时对话,兼顾流畅互动与低延迟。Extended Thinking版本则强化了多步骤逻辑推理能力,能自然地通过语音同步汇报任务进度,例如在后台查资料时说“让我查一下...”。它还能一边看画面一边聊天,例如看草图直接用语音生成React代码。
边想边说的实时语音大模型: Google 发布 Gemini 3.8 Live 与 Extended Thinking 把实时语音推向多步骤推理 基础版本 Gemini 3.8 Live 专注于大...
边想边说的实时语音大模型: Google 发布 Gemini 3.8 Live 与 Extended Thinking 把实时语音推向多步骤推理 基础版本 Gemini 3.8 Live 专注于大规模部署的高性价比。面向高并发、低延迟的日常助理与检索服务。支持在97种语言对话中自动识别并平滑过渡... 兼顾流畅的多模态实时互动(视觉+语音)与极具竞争力的运行成本。 Gemini 3.8 Live Extended Thinking 则主打企业级复杂任务执行。它重点强化了多步骤逻辑推理与规划能力,主要面向客户服务、专业排障、多系统协调等需要深度思考的生产环境 Thinking 版本实现了“实时思考与发音同步”。面对复杂问题时,它会自然地说出“让我查一下…”作为过渡,并在后台执行多步骤任务时同步向用户汇报进度,交流体验就像在与真人通电话。 后台异步工具调用:在调用外部 API、检索数据或订座的同时,前端的语音闲聊完全不中断,实现了真正的并发协作。 近实时多模态视觉理解:模型能一边看着画面一边聊天,例如实时根据员工入职环境答疑、看棋盘下棋,甚至看着草图直接用语音沟通并生成 React 代码。 Your browser does not support the video tag. 🔗 View on Twitter 💬 2 🔄 0 ❤️ 1 👀 1605 📊 2 ⚡