#Gemini
朋友,联想 Vantage 外设管理应用上架 Googlebook 了,能帮你管理设备状态和配置外设,还意外看到了他们新出的 AI Mouse,这个鼠标中键有实体 AI 键,能快速调用 Gemini 功能,挺方便的。
Google 新增了 Gemini API 的 Managed Agents 功能,让你能更方便地创建和管理智能体,实现更复杂的任务流程。
Google 新出的 Credentials API 很实用,能帮大模型安全地访问外部服务,比如 Slack 或其他工具,而且不会把你的密钥直接暴露给模型。
这个研究挺有意思的,用稀疏特征的方法分析了Gemini和Qwen在检测有害表情包时的表现,发现模型内部其实有相关证据,但读出机制出了问题,这个发现挺有深度的。
谷歌新出的Gemini 3.8 Live和Extended Thinking,能一边说话一边思考,比如查资料时能同步汇报进度,比普通语音助手更智能。
谷歌出了两个新的实时对话模型,支持 97 种语言切换,能自动检测语言,还能在对话中调用工具,比之前的模型更智能。
谷歌发布了Gemini 3.8 Live和Extended Thinking功能,前者在人工分析质量指数上达到82.6分(第一),后者能后台思考并异步调用工具。Gemini 3.8 Live的输入成本为每分钟0.005美元,输出成本为每分钟0.018美元,在τ-banking代理任务完成度上达到35.1分(第一)。
谷歌研究团队发布了新论文,用他们的agent harness在数学证明任务上取得了新进展,和之前的模型相比,这个方法在解决复杂问题上有不同优势。
谷歌新出的Gemini 3.8 Live音频模型,一小时才1.38美元,比OpenAI的GPT-Live-1便宜很多,适合开发者用。
谷歌发布了新的 Gemini 3.8 Live 模型,消费者现在可以在搜索里用到了,开发者也可以在 API 里体验,比之前的版本功能更强大。
谷歌发布了新的Gemini 3.8 Live和3.8 Live Extended Thinking版本,能更好地在后台处理对话和任务,体验更流畅。
谷歌新出的Gemini 3.8 Live Extended Thinking版本,编程辅导能力更强了,能实时理解代码和屏幕,还能自动处理多种语言,比之前版本好用。
朋友A告诉朋友B,前谷歌DeepMind的Qiyin Wu去百度了,负责大模型预训练,这可能是百度大模型团队的新成员。
苹果终于更新了Siri,这次用的是谷歌的Gemini模型,在设备上运行,部分通过云端。测试反馈说多步骤请求和屏幕上下文好用,但个人上下文信息处理有缺陷。
谷歌搞了个叫 Stellar Colosseum 的多代理框架,专门用来做数学和理论计算机科学这种需要长期研究的活儿,比单模型干得更好。