05:25Google Gemini App@GeminiAppGemini Live向全球符合条件的用户推出学习笔记本等功能升级。符合条件的学生可申请一年免费的学生计划。该计划有效至2026年12月31日。功能更新针对全球用户开放。AI产品Gemini Live学生计划功能体推荐理由:Gemini Live发布了新功能和学生优惠,学生能一年免费申请,比普通用户多这个福利。原文稍后读已读值得跟进有用关注 Gemini Live
23:47官方账号LangChain@LangChainAILangChain 的 Carol Di Vittorio 在 Google 开发者频道演示了用 Google ADK 和 Gemini Live 构建语音智能体。她展示了在 LangSmith 中追踪语音代理的每一步行为,包括工具调用、中断事件和 token 成本。视频还演示了如何设置 tracing,让开发者清楚看到智能体每次交互的内部流程。技巧Google ADKGemini LiveLangSmith推荐理由:想看语音智能体怎么调试?这个演示用 Google ADK + Gemini Live,再用 LangSmith 看清楚工具调用和 token 花费,直观。原文稍后读已读值得跟进有用关注 Google ADK
06:50Google Gemini App@GeminiAppGemini 团队将于7月29日11:30am PT在 Discord 服务器举办 Prompt Like a Pro 活动。团队成员将分享用户真实用例,并提供提示词优化技巧。活动覆盖 Gemini Omni、Gemini Live、Notebooks 等功能的进阶用法。参与者可在线学习如何提升提示词质量,充分利用 Gemini 特性。技巧GeminiDiscord提示词工程推荐理由:想用好 Gemini 的 Omni、Live 这些功能?官方团队手把手教你写提示词,还能看真实案例,别错过。原文稍后读已读值得跟进有用关注 Gemini
22:57Philipp Schmid@_philschmidGoogle DeepMind的Gemini Live实时语音代理现在可在LangChain中追踪speech-to-speech循环。Speaker回调钩子只捕捉中断事件前用户听到的精确音频。时间线高亮用户语音(蓝色)和Gemini响应(橙色),以及耗时1.29秒的城市天气查询等自定义工具执行。使用元数据区分常规文本token与原生Gemini音频token,便于精确计算用量。注册LangSmithGoogleADKLivePlugin即可启用。技巧Gemini LiveLangChainLangSmith推荐理由:谷歌这个新集成让你用LangChain看清Gemini Live语音交互的每一步,连1.29秒的天气查询都能追踪,调试超方便。原文稍后读已读值得跟进有用关注 Gemini Live
02:39Harrison Chase@hwchase17精选LangChain 发布 LangSmith 对四个语音框架的原生追踪集成:pipecat_ai、livekit、OpenAI Realtime 和 Gemini Live(Google ADK)。该功能让开发者在生产环境中实时监控语音 agent 的调用、延迟和错误,避免盲飞。每个集成支持完整的 trace 视图,包括输入输出、工具调用和性能指标。目前已在 LangSmith 中可用,用户可直接在 dashboard 中查看。AI产品LangSmith语音框架pipecat_ai10 个信源在谈事件专题推荐理由:搞语音 agent 的兄弟别瞎猜了,LangSmith 直接帮你盯住 pipecat、livekit、OpenAI 和 Gemini 的调用,生产排障省大事。原文稍后读已读值得跟进有用关注 LangSmith
02:09Harrison Chase@hwchase17精选本教程展示如何结合Gemini Live和deepagents子代理构建语音研究代理。Gemini Live提供低延迟、自然流畅的语音对话能力,而deepagents负责执行长时间运行的复杂任务。通过LangSmith实现全链路追踪与可观测性。该方法解决了语音代理中对话质量与可靠性的权衡问题。技巧Gemini LivedeepagentsLangChain推荐理由:LangChain发了个教程,教你用Gemini Live做语音代理,把复杂任务丢给deepagents子代理,既能低延迟对话又能跑长时间任务,挺实用的。原文稍后读已读值得跟进有用关注 Gemini Live
01:36官方账号LangChain@LangChainAILangChain介绍语音智能体构建的两种方案:Gemini Live实现低延迟的自然对话,Sandwich架构提供更可靠的流程控制。他们结合Gemini Live、Deep Agents和LangSmith构建了一个语音研究智能体,具备完整追踪与可观测性。该方案同时优化了对话质量和长期研究任务的可靠性。技巧LangChainGemini LiveDeep Agents推荐理由:LangChain教你如何混用Gemini Live和Sandwich架构,既做出流畅对话又保证任务可靠,实用技巧。原文稍后读已读值得跟进有用关注 LangChain
15:16AI Will@FinanceYF5Google 在 Gemini Live 中新增了图像创建和编辑功能,用户可以在使用 Gemini 应用时实时生成或修改图像。该功能通过实时摄像头共享实现,用户可以向 Gemini 展示正在观看的内容,并即时要求其创建、调整或解释视觉内容。这一更新将 Gemini 从纯文本助手扩展为多模态交互工具,提升了实时视觉处理的实用性。目前该功能已上线,适用于支持 Gemini Live 的设备。AI产品GoogleGemini Live实时图像生成推荐理由:实时图像生成与编辑让 Gemini 成为更强大的多模态助手,适合需要即时视觉创作或修改的用户,比如设计师、内容创作者和日常用户,建议打开 Gemini 试试这个新功能。原文稍后读已读值得跟进有用关注 Google
10:36官方账号Demis Hassabis@demishassabisGarry Tan 宣布开源项目 GBrain 发布 v0.40.0 版本,基于 Gemini Live 构建语音智能体。该智能体支持大上下文、优秀工具使用和完整大脑访问,可赋予 OpenClaw/Hermes Agent 语音交互能力。Garry Tan 将其描述为“火星是朋友,金星是你的 EA”,并作为开源礼物分享。此项目展示了 Gemini Live 在语音智能体领域的实际应用潜力。AI产品语音智能体Gemini Live开源/仓库8 个信源在谈事件专题推荐理由:语音智能体开发者可以直接用 GBrain 快速搭建基于 Gemini Live 的语音交互系统,开源且功能完整,值得一试。原文稍后读已读值得跟进有用关注 语音智能体
21:09TestingCatalog@testingcatalog72°Google正在为其桌面版Gemini应用开发多项新功能,包括Gemini Live、Gemini Spark、Gemini Omni以及“Stream to Cursor”特性。其中,“Stream to Cursor”类似上周Android Show上公布的“Magic Pointer”,可能实现屏幕内容与AI的实时交互。Gemini Spark Agent可操作本地文件夹中的文件,而Gemini Omni内部被称为“Veo4 Omni”,暗示与视频生成模型Veo的整合。这些功能目前仍在开发中,Gemini Live尚未完全可用,但已有测试者展示了简短演示。AI产品Gemini桌面应用Stream to Cursor3 个信源在谈事件专题推荐理由:Google桌面Gemini即将迎来一波实用更新,尤其是Stream to Cursor和本地文件操作能力,对重度使用AI助手的开发者和办公用户来说,值得关注这些新功能如何提升日常效率。原文稍后读已读值得跟进有用关注 Gemini