01:57Paul Couvert@itsPaulAiGoogle 发布了 frame.md,这是 design.md 的视频版本,旨在让 AI 代理能够根据品牌规范生成视频。design.md 此前已用于保持屏幕上的品牌一致性,但应用到视频时,代理会将其转回网页和幻灯片。frame.md 解决了这一问题,它教会代理如何制作品牌视频,用户只需将 design.md 转换为 frame.md 即可。这一创新有望简化视频内容创作流程,尤其适合需要大量品牌视频的团队。AI产品Googleframe.md视频生成推荐理由:做品牌视频的团队终于有了 AI 可读的规范——frame.md 让代理直接生成符合品牌调性的视频,省去反复调整的麻烦,建议内容创作者和营销团队点开看看。原文稍后读已读值得跟进有用关注 Google
00:33Philipp Schmid@_philschmid76°Google 发布了 Gemma 4 12B,这是其首个支持原生音频输入的中型多模态模型。该模型采用无编码器架构,直接将视觉和音频信息融入大语言模型,仅需 16GB 内存即可运行。在基准测试中,其性能接近 26B 参数模型,且采用 Apache 2.0 开源许可。这标志着中小型模型在多模态能力上的重要突破,尤其适合资源受限的开发者。AI模型Gemma 4多模态模型音频输入10 个信源在谈事件专题推荐理由:Gemma 4 12B 让中小团队也能用上原生音频多模态模型,16GB 内存门槛极低,做语音交互或视觉应用的开发者可以直接下载试试。原文稍后读已读值得跟进有用关注 Gemma 4
00:12Google Gemini App@GeminiAppGoogle 宣布 Gemini Spark 进入 Beta 阶段,首先面向美国地区的 AI Ultra 订阅用户开放。Gemini Spark 是 Google 最新推出的 AI 模型,旨在提供更高效、更智能的对话体验。此次 Beta 发布标志着 Google 在 AI 领域的又一重要进展,用户可以通过订阅服务率先体验。该模型可能集成在 Gemini 应用中,支持更复杂的任务处理。AI产品GoogleGemini SparkAI Ultra推荐理由:Google 在 AI 订阅服务上再落一子,Gemini Spark 的 Beta 上线意味着付费用户能抢先体验新能力。如果你是 AI Ultra 订阅者或关注 Google AI 生态,值得关注这次更新,看看它能否提升你的日常效率。原文稍后读已读值得跟进有用关注 Google
23:54elvis@omarsar076°Google 发布新研究 LEAP(Lean-Enhanced Agentic Programming),通过将通用大语言模型封装在智能体框架中,每一步都基于 Lean 编译器进行验证,并迭代利用验证器反馈。该框架使同一个通用模型解决了全部 12 道 Putnam 2025 数学竞赛题,并将 Lean-IMO-Bench 的一次性求解率从不到 10% 提升至 70%,超越了得分为 48% 的专用金牌系统。这项研究展示了定制智能体框架在数学推理任务上的巨大潜力,论文已发布在 arXiv 上。论文智能体数学推理Lean推荐理由:做数学推理或智能体开发的团队值得关注——LEAP 用通用模型+验证反馈循环就超越了专用系统,说明智能体框架设计比模型本身更关键,建议点开论文看具体架构。原文稍后读已读值得跟进有用关注 智能体
12:07AI Will@FinanceYF5Google 展示了其 Gemini Omni 模型的新能力,允许用户通过自然语言指令改变视频中的摄像机角度、调整视角或修改光照效果,同时保持物理规律和角色一致性。演示中,用户输入“把场景改成沙漠(其他不变)”,视频即被重新渲染。这一技术突破了传统视频编辑的局限,为内容创作者提供了前所未有的灵活性和控制力。它标志着多模态 AI 在视频理解和生成方面的重要进展,有望简化影视制作、广告和社交媒体内容创作流程。AI产品Gemini Omni视频编辑多模态AI推荐理由:视频创作者和后期团队终于可以像改文字一样改视频了——Gemini Omni 让你一句话调整视角和光照,还保持物理和角色一致,做内容生产的建议点开看看怎么用。原文稍后读已读值得跟进有用关注 Gemini Omni
10:23AI Will@FinanceYF5Google 在 YouTube 上推出名为 Ask YouTube 的对话式搜索体验,允许用户提出更复杂的查询,如规划加州海岸公路旅行或教孩子骑自行车的技巧。该功能会从 YouTube 全库(包括长视频和 Shorts)中整理最相关的视频,并以交互式结构化结果呈现,取代传统的视频推荐列表。目前仅对美国 Premium 会员开放,后续将向所有用户推广。这标志着 YouTube 搜索从关键词匹配向 AI 对话式理解的升级。AI产品对话式搜索YouTubeGoogle推荐理由:YouTube 重度用户终于可以像聊天一样搜视频了——复杂问题直接问,不用再手动翻几十个结果。做内容创作或经常用 YouTube 查攻略的,值得先试 Premium 体验。原文稍后读已读值得跟进有用关注 对话式搜索
09:13Gary Marcus@GaryMarcus精选Gary Marcus 指出,当前 AI 行业(包括 Google)被误认为会重现搜索引擎的赢家通吃格局(Google 占超 95% 搜索市场),但实际各家都在用同样的数据和方案,没有护城河。他认为没有明确赢家时只能打价格战,导致企业成本远超未来利润。他以 Alphabet 为例:去年 1600 亿美元运营现金流,却仍需发行 400 亿美元股权融资 AI 算力。行业Gary MarcusGoogleAlphabet4 个信源在谈事件专题推荐理由:Gary Marcus 质疑AI行业泡沫原文稍后读已读值得跟进有用关注 Gary Marcus
00:45Patrick Loeber@patloeber精选Google 于 6 月 1 日正式停用 Gemini 2.0 Flash 和 Gemini 2.0 Flash-Lite 两款模型。官方推荐用户迁移至 Gemini 3.5 Flash 和 Gemini 3.1 Flash-Lite。此次调整不涉及其他 Gemini 版本。AI模型Gemini 2.0 FlashGemini 3.5 FlashGoogle推荐理由:旧模型退役,快换新版本原文稍后读已读值得跟进有用关注 Gemini 2.0 Flash
11:38Gary Marcus@GaryMarcusAI 分析师 @scaling01 发布了一系列大胆预测,认为 OpenAI 将繁荣发展,Anthropic 将持续盈利,而谷歌和中国公司都无法追上它们。预测还指出,最高级别的智能将成为只有企业和富豪才能负担的奢侈品,但大多数重金投入的公司将获得巨大回报。此外,SpaceX 的 AI 将在年底前与谷歌持平,英伟达将成为首个市值突破10万亿美元的公司。这些观点挑战了当前行业共识,值得关注。行业OpenAIAnthropicGoogle10 个信源在谈事件专题推荐理由:这些预测直接挑战了当前 AI 行业的竞争格局和商业化路径,做 AI 投资或战略规划的读者值得一看,看完会对未来趋势有新的思考。原文稍后读已读值得跟进有用关注 OpenAI
11:31Gary Marcus@GaryMarcusAI 评论家 Gary Marcus 转发并点赞了用户 scaling01 的一系列具体预测,包括 OpenAI 将继续保持前沿地位且市值逐年增长、谷歌和中国公司无法在编程和研究速度上超越 Anthropic 或 OpenAI、SpaceX 的 AI 年底前将追平谷歌、Nvidia 将在 5 年内成为首家 10 万亿美元公司。预测还指出,最高等级的智能将成为奢侈品,月费 999 美元以上或每百万 token 超过 150 美元。Marcus 表示即使部分预测可能错误,也欣赏其具体性。行业OpenAINvidiaAnthropic10 个信源在谈事件专题推荐理由:这些预测直接点出了未来 5 年 AI 行业的赢家和输家,做投资、战略或技术选型的团队值得参考——尤其是 Nvidia 和 OpenAI 的长期前景判断。原文稍后读已读值得跟进有用关注 OpenAI
11:23Google Gemini App@GeminiAppGoogle 的 Gemini 团队发布了本月更新,包括重新设计的用户体验和名为 Gemini Spark 的 24/7 智能代理助手。新界面旨在提升交互流畅度,而 Gemini Spark 则提供全天候的智能协助功能。这些更新展示了 Google 在 AI 助手领域的持续投入,旨在为用户提供更便捷、更强大的 AI 服务。AI产品Gemini智能助手界面更新推荐理由:Gemini 用户和 AI 助手爱好者可以关注这次界面和功能升级,新设计的体验和全天候智能助手值得一试。原文稍后读已读值得跟进有用关注 Gemini
11:04Google Gemini App@GeminiAppGoogle 的 Gemini Omni 模型展示了从屏幕视频输入到现实物理模拟的端到端能力。用户只需一个提示词,模型就能理解视频内容,应用物理规则并生成无缝的新运动。该功能将视频理解与物理仿真结合,为创意内容生成和交互式应用开辟了新可能。目前已在 X 平台开放试用,用户可分享自己的实验案例。AI产品Gemini Omni视频生成物理模拟推荐理由:视频创作者和 AI 应用开发者可以直接用 Gemini Omni 把屏幕内容变成物理模拟视频,省去传统 3D 建模和动画流程,值得一试。原文稍后读已读值得跟进有用关注 Gemini Omni
10:48Google Gemini App@GeminiApp72°Google 宣布其自主 AI 智能体 Gemini Spark 现已向美国所有 Google AI Ultra 订阅用户开放。该智能体能够处理繁重任务,在用户的数字生态系统中连接信息并采取关键行动。用户可以选择观看其工作过程或让其在后台自主运行,即使手机和笔记本电脑关机也能持续工作。Gemini Spark 在执行重大操作前会征求用户同意,确保用户始终掌控。这一发布标志着 Google 在自主 AI 智能体领域的重要进展。AI产品智能体GoogleGemini Spark推荐理由:Google 终于推出了真正 24/7 后台自主运行的 AI 智能体,适合需要自动化处理复杂任务的数字重度用户,值得 Ultra 订阅者立即尝试。原文稍后读已读值得跟进有用关注 智能体
05:39官方账号Jeff Dean@JeffDean精选在Logan Kilpatrick主持的对话中,Gemini联合负责人Jeff Dean、Oriol Vinyals、Noam Shazeer和Koray Kavukcuoglu分享了Gemini的当前进展、发展历程及下一步计划。对话未披露具体基准分数或版本号,但涉及模型在多模态和推理能力上的方向。行业GeminiGoogle多模态推荐理由:听Gemini团队聊模型走向原文稍后读已读值得跟进有用关注 Gemini
03:36官方账号Logan Kilpatrick@OfficialLoganK精选Gemini联合负责人Jeff Dean、Koray Kavukcuoglu、Noam Shazeer和Oriol Vinyals在一场对话中回顾了Gemini的发展历程。他们讨论了Gemini在多模态推理和编程任务上的性能表现。对话还展望了下一步在Agent和工具使用能力上的增强方向。AI模型GeminiGoogle多模态推荐理由:Gemini团队亲自聊未来原文稍后读已读值得跟进有用关注 Gemini
18:34AI Will@FinanceYF5Google 推出 AI Threat Defense,这是一套由 AI 驱动的网络安全解决方案,旨在持续监控并阻止 AI 驱动的威胁。该方案整合了 Wiz 平台进行风险扫描与优先级排序,利用 Gemini 等前沿模型对高风险应用进行深度漏洞扫描,并通过新软件修复代理 CodeMender 加速漏洞修复。此外,Wiz 的自主代理会持续测试系统以发现未知漏洞。与其他仅标记漏洞的方案不同,Google 的方案主动优先处理最关键的现实风险,并利用多种模型协同修复。AI产品AI 安全威胁防御Google推荐理由:安全团队终于有了能主动防御 AI 威胁的完整方案——Google 把扫描、修复、测试全链路打通了,做企业安全运维的可以直接关注。原文稍后读已读值得跟进有用关注 AI 安全
16:55rohanpaul_ai@rohanpaul_aiGoogle 修复了 Gemini 使用配额中的多个问题,包括因 Bug 导致 1-2 个 Omni 视频耗尽部分用户配额的情况。Ultra 用户现在获得 2 倍 Omni 生成次数;Pro 提示词新增每次提示的配额上限;失败请求不再计入配额;Flash-Lite 模型免费且不消耗配额。此外,即将推出更细粒度的使用量分解和警报功能,且选定模型将保持记忆,除非用户手动更改或达到上限。这些改进显著提升了 Gemini 的使用体验和配额透明度。AI产品Gemini配额修复Omni推荐理由:重度 Gemini 用户终于不用被配额 Bug 困扰了,Ultra 用户 Omni 生成翻倍直接受益,做多模态创作的团队建议更新后试试。原文稍后读已读值得跟进有用关注 Gemini
07:05Gary Marcus@GaryMarcus精选Gary Marcus 在 X 上引用 METR_Evals 的结果,反驳某英国大报声称 AI 能完成任何人类任务的论断。他指出 Google 连可靠计数都做不到,且 METR 的测试仅针对软件领域,不要求完全准确。许多人类数秒即可完成的任务,AI 仍然无法可靠执行。行业Gary MarcusMETR_EvalsAI能力评估推荐理由:戳破AI万能论,带你看清真相原文稍后读已读值得跟进有用关注 Gary Marcus
03:03Google Gemini App@GeminiApp精选Gemini App 宣布印度用户现在可以上传视频并使用 Gemini Omni 进行编辑和变换。该功能支持从相机胶卷或保存的文件中上传。Gemini Omni 被描述为在 Vibe 视频编辑方面超越一切。目前该更新是否会在印度以外地区推出尚未明确。AI产品Gemini AppGemini OmniGoogle推荐理由:谷歌推出 Gemini Omni 视频编辑原文稍后读已读值得跟进有用关注 Gemini App
22:50官方账号Decoder@Jonathan KemperGoogle 在 Google I/O 上发布了 Coral Board,一款紧凑型单板计算机,专为设备端 AI 设计。该板卡能够本地运行 Gemma 3 模型,无需依赖云端。这为边缘计算和物联网设备提供了强大的 AI 能力,降低了延迟并增强了隐私保护。开发者可以将其用于智能家居、工业自动化等场景,实现实时推理。AI产品GoogleCoral BoardGemma 31 个信源在谈事件专题推荐理由:边缘 AI 终于有了官方硬件方案——Coral Board 让 Gemma 3 在本地跑起来,做嵌入式或物联网的开发者可以直接用它部署模型,省去云端依赖。原文稍后读已读值得跟进有用关注 Google
10:28Google Gemini App@GeminiAppGoogle 宣布 Gemini Omni 现已面向所有 Google AI Plus、Pro 和 Ultra 订阅用户开放,支持网页版和 Gemini 应用。该功能提供了更强大的多模态交互能力,用户可以在对话中同时处理文本、图像和音频。此次开放标志着 Gemini 在多模态 AI 领域的重要进展,订阅用户可以直接体验。AI产品Gemini多模态订阅服务推荐理由:多模态交互是 AI 的下一个关键方向,Gemini Omni 让订阅用户能同时处理文本、图像和音频,做内容创作或数据分析的团队值得立即体验。原文稍后读已读值得跟进有用关注 Gemini
18:44宝玉@dotey一篇对 Gemini 前核心科学家 Andrew Dai 的专访揭示,Google 在技术储备上其实早于 OpenAI:2021 年就做出了比 GPT-3 更强的 MoE 大模型 GLaM,PaLM 2 也在 2023 年初训练完成。但组织问题拖累了发布节奏——为了等 Google I/O,PaLM 2 被刻意延迟,而 OpenAI 抢先发布 GPT-4,改写了市场叙事。这解释了为什么 Gemini 2.5 Pro 之前,Google 模型从未超越 GPT-4。行业GeminiGPT-4Google10 个信源在谈事件专题推荐理由:做 AI 产品战略或关注模型竞争的读者,这篇专访点出了技术领先不等于市场领先的残酷现实——Google 的组织惯性如何让先发优势变成后发劣势,值得所有技术团队反思。原文稍后读已读值得跟进有用关注 Gemini
12:00AI Will@FinanceYF5Google 的 SynthID 技术选择在 AI 生成内容的源头嵌入数字水印,而非事后检测,目前已标记超过 1000 亿条内容。OpenAI 和 ElevenLabs 也宣布接入该方案,推动 AI 内容透明度成为行业基础设施。这一做法旨在解决 AI 生成内容难以识别的问题,为内容溯源和可信度提供底层支持。随着更多平台加入,水印标准有望统一,影响内容审核、版权保护和用户信任。AI产品AI 内容识别数字水印SynthID10 个信源在谈事件专题推荐理由:AI 内容真假难辨是所有人的痛点,SynthID 从源头打水印的思路比事后检测更靠谱,做内容平台、审核或版权管理的团队值得关注这个行业趋势。原文稍后读已读值得跟进有用关注 AI 内容识别
16:32AI Will@FinanceYF5Google 发布了 Antigravity CLI,让用户可以在终端中直接使用 Antigravity agent。该 CLI 版本轻量、功能完整且完全可定制,满足了部分开发者希望在命令行环境中使用 agent 的需求。在 AI 工具普遍转向 GUI 的趋势下,Google 反其道推出 CLI 版本,为偏好终端操作的开发者提供了新选择。AI产品AntigravityCLI终端推荐理由:终端党终于等到了官方 CLI 版 Antigravity agent,做自动化脚本或习惯命令行的开发者可以直接上手,省去 GUI 的繁琐。原文稍后读已读值得跟进有用关注 Antigravity
06:36rohanpaul_ai@rohanpaul_ai72°Google 新论文指出,大语言模型的幻觉问题根源不在于回答错误,而在于错误时仍显得过于自信。论文提出应将目标从追求完美事实性转向让模型诚实表达自身不确定性,即“忠实的不确定性”。作者认为,模型缺乏的不是知识,而是对自身认知的元认知能力。对于智能体而言,不确定性感知能决定何时搜索、何时信任来源、何时停止,比工具本身更重要。论文LLM幻觉不确定性推荐理由:这篇论文点破了 LLM 幻觉的核心矛盾——不是知识不够,而是不知道什么时候该说“不确定”。做 AI 产品、智能体或对话系统的团队,看完会对“诚实比正确更重要”有更深理解,建议直接读原文。原文稍后读已读值得跟进有用关注 LLM
21:30The Rundown AI@therundownaiGoogle 的 AI 系统成功解决了九个长期未解的数学难题,标志着 AI 在数学推理领域取得重大突破。这些难题曾困扰数学家多年,AI 的解法可能为数学研究开辟新路径。该成果展示了 AI 在复杂逻辑和抽象推理方面的潜力,对数学、计算机科学等领域具有深远影响。AI模型GoogleAI 数学推理未解难题推荐理由:数学和 AI 研究者值得关注——Google AI 破解未解难题,可能改变数学研究范式,建议点开了解具体突破。原文稍后读已读值得跟进有用关注 Google
23:36官方账号Logan Kilpatrick@OfficialLoganK精选Gemini 3.5 Flash 模型在 Vending Bench 基准测试中达到性价比帕累托前沿。Vending Bench 用于衡量模型运行模拟商店的能力。该模型在成本与智能之间取得最优平衡,优于其他竞品。这是 Gemini 系列在推理效率上的重要进展。AI模型Gemini 3.5 FlashGoogleVending Bench推荐理由:谷歌新模型性价比超群原文稍后读已读值得跟进有用关注 Gemini 3.5 Flash
21:11官方账号Decoder@Jonathan Kemper精选Google 在其 Lighthouse 分析工具中新增了名为“Agentic Browsing”的实验性审计类别,用于测试网站对 AI 智能体的兼容性。该审计会检查网站是否包含 llms.txt 文件,该文件可帮助 AI 模型理解网站结构和内容。此举旨在推动网站优化以更好地支持 AI 代理的浏览和交互,提升智能体在网页上的自动化操作能力。这对依赖 AI 代理进行数据抓取或自动化任务的开发者具有重要意义。AI产品GoogleLighthouseAgentic Browsing推荐理由:做网站优化或 AI 代理开发的团队,这个新审计能帮你提前适配智能体浏览标准,建议点开看看具体检测项。原文稍后读已读值得跟进有用关注 Google
08:27rohanpaul_ai@rohanpaul_ai精选72°Google 发表新论文,提出 SensorFM,一个基于 500 万人超过 1 万亿分钟未标记穿戴传感器数据训练的基础模型。该模型旨在学习人类生理活动的通用模式,而非仅处理孤立事件。SensorFM 在 35 项预测任务中的 34 项上超越了传统特征工程方法,涵盖心血管、代谢、心理健康、睡眠和生活方式等领域。研究表明,穿戴数据的价值在于先学习其内在结构,而非过早压缩为粗略摘要。论文基础模型穿戴设备生理信号推荐理由:穿戴设备厂商和健康 AI 研究者终于有了一个通用基础模型,不用再为每个健康任务单独设计特征工程。做可穿戴健康分析的团队可以直接参考 SensorFM 的预训练思路,大幅降低模型开发成本。原文稍后读已读值得跟进有用关注 基础模型
02:16官方账号Logan Kilpatrick@OfficialLoganK精选Gemini 3.5 Flash 在 Roboflow 视觉评估中多项指标超越 3.1 Pro。其平均推理速度快约6倍,大幅降低延迟。该模型在多模态理解上展示出更强能力,尤其适合视觉密集型任务。AI模型Gemini 3.5 FlashGemini 3.1 ProGoogle推荐理由:谷歌新 Flash 视觉又快又准原文稍后读已读值得跟进有用关注 Gemini 3.5 Flash
00:01a16z@a16z精选Google 目前每月处理超过 3.2 quadrillion 个 Token,相比一年前增长了 7 倍。这一数据来自 a16z 发布的图表。Token 处理量的激增反映了 Google 在 AI 和搜索领域的大规模部署。行业Googletokensa16z推荐理由:Google 处理量暴增 7 倍原文稍后读已读值得跟进有用关注 Google
19:27rohanpaul_ai@rohanpaul_aiGoogle CEO Sundar Pichai 在播客中透露,2022 年 Google 已基于 LaMDA 模型开发出接近 ChatGPT 的产品,但因模型输出毒性过高、不符合 Google 搜索质量标准而放弃公开发布。Pichai 承认公司当时对产品质量有更高门槛,且事后看 OpenAI 的 ChatGPT 也并非一开始就明显是赢家。Google 曾通过 AI Test Kitchen 发布受限版 LaMDA,但最终未全面推出。这一决策让 Google 在对话 AI 浪潮中落后,但也反映了其谨慎的产品哲学。行业GoogleLaMDAChatGPT10 个信源在谈事件专题推荐理由:Pichai 的复盘揭示了科技巨头在 AI 产品化中的两难——质量 vs 速度,做 AI 产品决策的团队值得看看 Google 当年为何选择不赌。原文稍后读已读值得跟进有用关注 Google
08:31DeepLearning.AI@DeepLearningAI研究发现,Google 的 AI 系统在乳腺钼靶图像中检测癌症的准确率略高于人类放射科医生。该系统能够发现一些医生最初遗漏的病例,同时有望减轻放射科医生的工作负担。然而,研究人员指出,信任问题仍是该技术临床推广的主要障碍。AI产品GoogleAI 医疗乳腺癌检测推荐理由:AI 在医疗影像诊断中展现出超越人类的潜力,做医学影像分析或关注 AI 落地的读者值得关注这项进展,了解其优势与挑战。原文稍后读已读值得跟进有用关注 Google
08:05The Rundown AI@therundownaiOpenAI 在数学领域取得突破,破解了一个困扰学界 80 年的数学猜想,展示了 AI 在基础科学推理上的潜力。Google 的 AI Co-Scientist 系统开始进入实验室实际应用,辅助科学家进行实验设计。此外,Anthropic 推出 Claude 上下文审计功能,帮助用户了解 AI 如何理解自己的工作。Emergence 公司发起五镇 AI 对齐挑战赛,探索多智能体协作中的价值观对齐问题。本周还有 4 款新 AI 工具和社区工作流发布,值得关注。行业OpenAIGoogleAI Co-Scientist10 个信源在谈事件专题推荐理由:数学和科学研究者会看到 AI 如何从工具变成合作者——OpenAI 的突破和 Google 的实验室应用都指向同一个方向:AI 正在改变科研范式,做基础研究的团队值得跟进。原文稍后读已读值得跟进有用关注 OpenAI
07:53AI Will@FinanceYF5Google 发布了名为 Gemini Omni 的新模型,能够从任意输入(如视频)生成任意内容。该模型首先支持视频输入,类似“Nano Banana”但针对视频场景。目前已在 Gemini App、Flow 和 YouTube 中可用,API 支持即将推出。这标志着多模态 AI 能力的重大扩展,让用户能更灵活地创作和交互。AI模型Gemini Omni多模态视频生成推荐理由:多模态 AI 又进一步——Gemini Omni 从视频直接生成内容,做视频创作或内容生产的团队值得关注,API 开放后可以直接集成到工作流中。原文稍后读已读值得跟进有用关注 Gemini Omni
07:35The Rundown AI@therundownai72°在 Google I/O 2025 上,CEO Sundar Pichai 接受了独家专访,重点介绍了新发布的 Omni(跨设备个性化智能)和 Spark 智能体。Pichai 将 Omni 比喻为“视频界的 Nano Banana”,并讨论了 YouTube 的未来、AI 怀疑论者的建议、Gemini 的普及策略,以及 AI 在三年内的发展方向。他还回答了 AI 不会取代哪些任务、对 18 岁青年的建议,以及如今是否还会上大学等个人问题。行业GoogleSundar PichaiOmni推荐理由:想了解 Google 对 AI 未来的真实战略,而不是产品参数?Pichai 的访谈直接给出了 Omni 和 Spark 的定位,做 AI 产品规划或关注巨头动向的读者值得一看。原文稍后读已读值得跟进有用关注 Google
15:20AI Will@FinanceYF5Google 发布了全新模型 Gemini Omni,能够根据任意输入(如文本、图像、音频)生成任意输出内容,首先支持视频生成。该功能将集成到 Gemini App、Flow 和 YouTube 中,API 支持即将推出。Omni 被视为“Nano Banana”的视频版,标志着多模态生成能力的重大突破。这一进展将极大简化内容创作流程,尤其对视频创作者和开发者意义重大。AI产品Gemini Omni多模态生成视频生成推荐理由:多模态生成从文本扩展到视频,做内容创作或视频开发的团队可以直接在 Gemini App 和 YouTube 中体验,建议第一时间试用。原文稍后读已读值得跟进有用关注 Gemini Omni
08:01Google Gemini App@GeminiAppGoogle 宣布全球 AI Plus、Pro 和 Ultra 订阅用户现可在 Gemini 应用中试用 Gemini Omni 功能。该功能允许用户直接在应用内进行多模态交互和创作。Google 鼓励用户分享自己的创作成果。此举标志着 Google 在 AI 多模态能力上的进一步扩展,面向高级订阅用户开放。AI产品Gemini多模态订阅用户推荐理由:Google 将多模态 AI 能力直接集成到 Gemini 应用中,Plus/Pro/Ultra 订阅用户现在就能上手体验,做内容创作或 AI 实验的团队值得一试。原文稍后读已读值得跟进有用关注 Gemini
08:00官方账号Simon Willison@simonwSimon Willison 在 X 上提问,Google 的 Gemini Spark 模型声称运行在 Gemini 3.5 上并使用 Antigravity 框架。他疑惑 Antigravity 是 Google 对智能体框架的通用称呼,还是类似 Claude 的 Claw 的竞品,并且是否开源。这条推文引发了对 Google 智能体技术栈的讨论。AI产品智能体GeminiAntigravity推荐理由:Google 的智能体框架命名引发猜测,做 AI 智能体开发的团队值得关注——这可能意味着 Google 在智能体领域有了新动作。原文稍后读已读值得跟进有用关注 智能体
08:00官方账号Simon Willison’s Weblog(博客/媒体)76°llm-gemini 插件更新至 0.32 版本,新增了对 Gemini 3.5 Flash 模型的支持。该模型是 Google 最新推出的轻量级模型,旨在提供更快的推理速度和更低的成本。作者还分享了使用该模型绘制鹈鹕的示例,展示了其生成能力。对于使用 LLM 命令行工具的用户,这次更新意味着可以更方便地调用 Gemini 3.5 Flash 进行文本生成和创意任务。AI产品GeminiLLM模型更新推荐理由:LLM 命令行用户可以直接升级体验 Gemini 3.5 Flash 的快速推理,做创意生成或快速原型验证的开发者值得一试。原文稍后读已读值得跟进有用关注 Gemini