7月1日
04:28
04:28官方账号Google DeepMind@GoogleDeepMind
78°
Google DeepMind 推出 Nano Banana 2 Lite,这是其最快且最便宜的 Gemini 图像模型。同时发布 Gemini Omni Flash,可通过 Gemini API 和 Google AI Studio 使用,帮助开发者生成和编辑高质量视频。两个产品均已开始提供。
事件专题

推荐理由:Google 一口气发了两个新东西:一个超快的图像模型 Nano Banana 2 Lite,一个能生成视频的 Gemini Omni Flash API,都是实际能用的。
04:27
04:27官方账号Google DeepMind@GoogleDeepMind
Google DeepMind 发布 Interactions API,允许将 Nano Banana 2 Lite 和 Gemini Omni Flash 两个模型串联使用。用户可先用 Nano Banana 2 Lite 生成图像,再通过 Gemini Omni Flash 将其动画化。该 API 支持会话历史,可堆叠最多三次顺序编辑。
事件专题

推荐理由:DeepMind 让 Nano Banana 和 Gemini Omni 能配合干活了,先画图后动画,还能连续改三次,挺实用。
04:17
04:17Guillermo Rauch@rauchg
Vercel CEO Rauchg宣布与Shopify团队合作重建Hydrogen框架。新框架采用agent-first设计,运行时无关,可在任何JavaScript环境运行。目前已提供基于Next.js的开发者预览版。项目旨在推动agentic web发展。
推荐理由:Vercel和Shopify联手重做了Hydrogen,搞了个agent-first的新框架,还能直接用Next.js体验。想搞agentic web的可以试试。
04:13
04:06
03:49
03:36
03:36Notion@NotionHQ
72°
Notion 现已集成 Claude Sonnet 5,这是目前能力最强的 Sonnet 版本。在代码编写上更智能,对智能体(Agent)任务更可靠,处理长文本任务表现更好。用户可直接在 Notion 内调用该模型,无需切换工具。
事件专题

推荐理由:Notion 内置 Claude Sonnet 5 了,写代码和跑智能体任务都更稳,长文档处理也有提升,不用再切窗口了。
02:57
02:57LlamaIndex@llama_index
精选
LlamaIndex发布LlamaParse MCP更新,支持从合同、发票和报告中自动提取结构化数据。代理可直接搜索、阅读并检索PDF、Office文档和图片等知识库内容。工具按分类、提取和搜索等任务重新组织,可并行执行。这提升了大规模文档处理的可靠性和效率。

推荐理由:LlamaIndex更新了LlamaParse MCP,现在代理能自动从合同发票抽数据,还能直接搜公司文档,处理大批文件快多了。
02:48
02:48Amjad Masad@amasad
精选
AI推理成本高昂的原因之一是多数工作负载运行在预LLM时代的通用硬件上。Etched从隐身模式亮相,其系统专为现代推理从零设计。公司已获得超过10亿美元客户合同和8亿美元融资。早期测试显示,在推理工作负载上吞吐量、延迟和能效均达到SOTA。首批机架将于今年夏季发货。
事件专题

推荐理由:Etched做了专为AI推理优化的芯片,比通用硬件在吞吐、延迟、能效上都做到了目前最好。今年夏天就发货,关注成本的人可以看看。
01:23
01:23官方账号NVIDIA AI@NVIDIAAI
精选
NVIDIA TAO 7 允许用户用自然语言向编码代理描述需求,自动执行模型调优。其 Agent 技能可接入编码代理并提升准确率,AutoML 自动搜索超参数,LLM 引导调优比传统方法快 2 倍。支持在本地 NVIDIA GPU 上微调任何 Hugging Face 的 CV 或 VLM 模型,数据增强微调能帮助代理识别失败原因并修复。
事件专题

推荐理由:NVIDIA 发布了 TAO 7,你只需用大白话告诉编码代理要啥,它就能自己调模型,比手动调参快两倍,还能本地跑 Hugging Face 模型。
00:47
00:47Aravind Srinivas@AravSrinivas
71°
Perplexity Computer 宣布接入 Forge Global 的私人市场数据。用户可直接查询私人公司的融资历史、隐含估值、二级定价等财务信息,无需额外订阅 Forge。该功能无需任何设置即刻可用,覆盖公司简介等多维度数据。
推荐理由:Perplexity 整合了 Forge Global 的私人公司财务数据,查估值和融资记录省去单独订阅,点一下就有。
00:46
00:46官方账号LMSYS Org (SGLang)@lmsysorg
精选72°
SGLang 集成百度无限 OCR 功能,通过参考滑动窗口注意力(R-SWA)替换传统解码注意力,使 KV 缓存大小在整个解码过程中保持恒定。该方案在单次前向传播中可处理最长 32K token 的文本,转录数十页文档。其高压缩率来自 DeepSeek OCR 编码器,且 R-SWA 方法可扩展至 ASR、翻译等任务。

推荐理由:SGLang 新功能无限 OCR 能一口气处理几十页文档,显存占用不变,比传统注意力省资源,适合长文档批量 OCR 场景。
00:33
00:33Harrison Chase@hwchase17
harbor是一个用于评估长时间运行、有状态智能体的框架。它正在成为行业标准,支撑着terminal bench 2等基准测试。LangChain已将harbor深度集成到LangSmith、Sandboxes和Deep Agents中。这有助于开发者更高效地评测智能体性能。
推荐理由:想给长时间运行的有状态智能体做评测?用harbor吧,已经是行业标准,LangChain全家桶都深度集成了,省心。
00:31
00:31coderabbitai@coderabbitai
CodeRabbit Agent 现在可以在 Discord 中运行,直接在社区频道内处理 PR 修复、自动化任务和代码工作。该功能支持范围限定,防止服务器被滥用。对于开源项目,CodeRabbit Agent 免费使用。

推荐理由:CodeRabbit 的 AI 代码审查工具上线 Discord,在聊天频道里就能处理 PR 和自动化,开源项目还免费,团队协作更方便了。
00:28
00:28官方账号LangChain@LangChainAI
精选
Harbor框架新增与Deep Agents、LangSmith Sandboxes和LangSmith Observability的直接集成。用户可在真实、可复现、隔离的环境中运行代理,支持多次并行执行和最终确定性检查。该集成简化了AI代理的测试与可观测性工作流。
推荐理由:Harbor框架现在可以直接接Deep Agents和LangSmith,帮你并行跑代理测试,环境隔离还能自动检查结果,省心多了。
00:23
00:17
00:17Yangyi@Yangyixxxx
NewMax发布V1.1.1版本,新增浏览器录制功能,可将操作流程自动转化为Playwright脚本。相比Codex,它不仅能学习用户操作,还能沉淀为可复用的自动化工作流。录制功能减少了二次开发消耗,执行速度更快。新版本已开放下载。
推荐理由:NewMax新版本能录制浏览器操作并直接生成Playwright脚本,比Codex更实用,省去手动编写代码的麻烦。做自动化可以试试。
6月30日
23:16
23:16官方一手歸藏(guizang.ai)@op7418
CodePilot 0.5.6.3 版本已更新,新增 ClinePass 和 Opencode GO 两个 Codeplan 套餐。Cline 推出每月 9.9 美元的 token plan,支持 DeepSeek、Kimi、MiniMax、MIMO、千问和 GLM5.2 等模型。目前还有 1.99 美元的优惠价。海外聚合 token plan 增多,方便调用多家推理服务。

推荐理由:CodePilot 更新了,新出的 Cline 套餐 9.9 美元就能用 DeepSeek、Kimi 等好几个模型,还有 1.99 美元优惠,写代码试试呗。
19:17
19:17Geek@geekbb
一个用 Go 开发的 CLI 工具,集成了 Web 搜索(Brave、DDG、SearXNG、Exa)、代码搜索(Grep、Sourcegraph、GitHub)和库文档查询(Context7)。支持网页抓取和站点爬取,为 AI Agent 提供无状态的终端搜索能力。GitHub 仓库已公开,地址为 github.com/1broseidon/ket…。
推荐理由:Go 写的 CLI 工具,把 Brave 搜索、GitHub 代码搜索、Context7 文档查询全整合到一起,AI Agent 可以直接调用来抓网页或搜代码,效率很高。

仅展示最近 2000 条内容。更早的内容请查阅 AI 日报存档(侧边栏 → AI 日报 → 顶部「往期日报」)。