8月5日
01:21
01:21Geek@geekbb
Vercel 发布了完全开源的 agent-browser,这是一个命令行浏览器工具。它运行在 Vercel Sandbox 中,为 AI agent 提供远程、可编程的浏览器会话。该工具支持命令共享,方便多个 agent 协作操作同一浏览器实例。

推荐理由:Vercel 开源了 agent-browser,把命令行浏览器塞进云端沙盒,AI agent 能远程编程控制、共享会话,比本地方案更方便。
00:58
00:58官方账号NVIDIA AI@NVIDIAAI
精选
NVIDIA Jetson AI Lab在X平台发布直播,主题为在Jetson上构建NemoClaw Agents。直播演示了在Jetson硬件上部署NemoClaw并搭建智能体的流程。该活动面向开发者,提供边缘端运行NemoClaw智能体的参考。
事件专题

推荐理由:NVIDIA官号直播教你在Jetson上搭NemoClaw智能体,想搞边缘Agent的可以看看。
00:57
00:57Julien Chaumond@julien_c
Not Diamond 发布 Code,号称世界最强大的智能模型路由器,专为长时程编码代理设计。该路由兼容 Claude Code 等网关或框架,可为每个步骤选择最佳模型和推理力度。官方称其能将成本降低 20-65%,同时不影响输出质量。
推荐理由:新出的 Not Diamond Code 能在编码代理跑每一步时自动选最合适的模型,省 20-65% 的钱,效果还不打折。
00:52
00:52Firecrawl@firecrawl_dev
72°
Firecrawl 今日发布开源文档解析引擎 anydoc,基于 Rust 编写。它能在 5 毫秒内将 PDF、Word、幻灯片等 13 种格式转换为 Markdown,处理 500 个 docx 文件仅需 1.7 秒。anydoc 已全面支撑 Firecrawl 的 /parse 端点,开发者和智能体可获得百倍速本地解析能力。
事件专题

推荐理由:Firecrawl 把解析器开源了,anydoc 用 Rust 写,PDF、Word 转 Markdown 只要几毫秒,装个包就能跑,比原来快 100 倍。
00:27
00:27官方账号LangChain@LangChainAI
精选
LangSmith LLM Gateway 支持用户定义跨模型和主机的模型回退规则。当某家模型提供商出现宕机或速率限制时,网关会自动把请求路由到备用模型。该功能面向所有基于 LangChain 构建的智能体,避免单一服务故障拖垮整个 Agent。

推荐理由:LangChain 给 LangSmith 网关加了个模型回退功能,一个模型挂了自动切另一个,省得智能体跟着宕机。
00:09
8月4日
23:36
22:35
22:35官方一手Hugging Face: Blog博客/媒体
Liquid AI 推出 LFM2.5-2.6B,一个 26 亿参数的语言模型。该模型面向本地智能体部署,减少对云端依赖。模型权重托管在 Hugging Face,开发者可直接下载。其体积适合在边缘设备上运行。
事件专题

推荐理由:想在自己电脑上跑智能体?Liquid AI 的 LFM2.5-2.6B 只有 2.6B 参数,不用联网,下载就能用。
21:30
21:30官方一手Cloudflare Blog@Will Papper
Cloudflare发布Cloudflare Wallets,这是一个面向AI智能体的可编程钱包。该钱包基于x402协议,为智能体提供原生支付与可验证身份。智能体可在预设安全护栏内自主购买API和数字内容。
事件专题

推荐理由:Cloudflare整了个给AI代理用的钱包,能靠x402协议自动付钱买API,还带安全限制,挺实用。
21:28
21:28官方一手Cloudflare Blog@Tomáš Hobza
精选
Cloudflare 发布 CI SDK,可在其平台上用 TypeScript 构建可定制的沙箱化 CI/CD 流水线。该流水线使用 Workflows 和 Artifacts 替代传统 YAML 配置,把复杂逻辑拆分为可编程步骤。方案面向数百万个仓库的批量运行场景,并配有自愈 AI 代理自动处理失败任务。
推荐理由:Cloudflare 搞了个 CI SDK,可以直接用 TypeScript 写流水线,不用再折腾 YAML 了,还带 AI 代理自动修复失败任务。
21:27
21:27官方一手Cloudflare Blog@Timo Reimann
精选
Cloudflare 创建了 Codex,一个由 AI 代理在开发生命周期中消费的治理工程标准体系。它将结构化 RFC 与代理审查结合,让团队在代码、规格说明和事件报告中自动执行一致性标准。这套机制帮助工程组织减少人工核对环节,让规范落地更统一。
推荐理由:Cloudflare 把工程标准塞给 AI 代理去执行,代码和文档不合规会被自动揪出来,省了大把人工审查时间。
21:25
21:25官方一手Cloudflare Blog@Fred Schott
Cloudflare发布了新工具Cloudflare Agents。它将所有已部署的Agent会话整合到单一界面中。该工具会展示关键运行信息与性能洞察。用户可借此观察Agent在规模化运行时的表现。
推荐理由:Cloudflare出了个Agents面板,能把所有部署的Agent会话汇总到一起,看运行表现和关键指标,挺实用的。
18:59
18:59The Rundown AI@therundownai
多家AI实验室前往白宫,与政府讨论AI安全议题。HeyGen创始人用AI克隆版本取代自己,参与公司对外事务。业界开始尝试构建一个项目室,让人和AI智能体在同一空间协作。金融业高管发现,AI技能比MBA学位更有价值。

推荐理由:今天AI圈几条重点:白宫聊安全,HeyGen创始人直接让AI克隆替自己上班,还有金融大佬觉得AI技能比MBA值钱。
17:14
17:14Geek@geekbb
Vercel Labs 在 GitHub 发布了营销团队 AI 智能体模板。该模板基于 eve 构建,集成了 Notion、Resend、Typefully 等工具。用户可以通过模板快速搭建自动化的营销协作流水线。模板代码已开源在 Vercel Labs 的 GitHub 仓库中。
事件专题

推荐理由:Vercel Labs把eve智能体跟Notion、Resend、Typefully串起来了,装好模板就能跑通营销自动化流程,适合团队直接抄作业。
16:50
16:50官方一手pandaily@contact@pandaily.com (Pandaily)
金山灵犀、腾讯QClaw、阿里千问办公和字节豆包与飞书的集成正在重塑企业办公,智能体取代传统功能成为任务入口。飞书、钉钉和企业微信则退居为支撑性基础设施。字节、腾讯、阿里和WPS四大厂商围绕企业AI工作流展开竞争。这场变革的核心是让智能体直接承接用户指令并调度办公工具。
事件专题

推荐理由:字节、腾讯、阿里和WPS都在做办公智能体,豆包现在能直接进飞书接活,腾讯QClaw也来抢入口,办公软件要变天了。
16:46
16:46官方一手Pandaily@contact@pandaily.com (Pandaily)
腾讯WorkBuddy 5.0发布安全中心,在操作系统API层引入默认安全沙箱。文件删除改为回收站式机制,支持恢复。文档编辑支持版本回滚,防止误操作。这些安全设置作为Agent默认选项,不牺牲执行效率。

推荐理由:腾讯把WorkBuddy的安全底子做厚了,默认开沙箱和回收站,删错文件还能恢复,打算用Agent办公的可以看看。
16:43
16:43官方一手pandaily@contact@pandaily.com (Pandaily)
Moonshot AI的Kimi K3、阿里Qwen3.8-Max和字节Doubao-Seed-2.1均采用原生多模态训练,而DeepSeek、智谱和腾讯混元仍坚持纯文本路线。在长程智能体任务中,视觉信息的实时参与成为决定性因素。这一差异将影响下一代模型在复杂环境中的表现。
事件专题

推荐理由:Kimi K3和DeepSeek V4现在走了两条路:一个搞原生多模态,一个纯文本硬扛。长任务里能不能看懂画面,差距会越来越大。
12:50
12:50官方账号arXiv cs.AI@Taye Akinrele, Sindhuja Penchala, Noorbakhsh Amiri Golilarz, Sudip Mittal, Shahram Rahimi
该论文提出一种针对生成式与智能体AI认知能力差距的分类法综述,围绕持久状态建模、目标导向自主性、自我监控与控制、环境交互、学习与适应五个维度组织现有研究。论文回顾了各维度的最新进展,指出常见局限,并提出自适应认知智能架构(ACIA)作为统一框架。还讨论了以认知为中心的评价方向,为迈向长期可靠推理和持续学习的认知AI提供路线图。
推荐理由:这篇综述把生成式和智能体AI的认知短板按五个维度梳理清楚了,还给了个ACIA架构思路,适合想系统了解认知AI研究现状的人。
12:48
12:48官方账号arXiv cs.AI@Ortal Ashkenazi, Vitalii Kloz, Mykhailo Ulianchenko
Wix在客服助手Helpmate中部署三阶段技能选择管线:语义匹配、确定性可执行性门控、LLM决策。在756.6K条用户消息和267.6K对话中,门控移除了59.4%的技能-消息对,节省228.8百万token。相比暴露全部十个技能,上下文减少90.5%。反事实测试中,若不设门控,模型会在7.8%的对话中选择无法执行的技能。
推荐理由:Wix用确定性门控砍掉59.4%无用技能调用,省2.3亿token,还量化了不设门控的7.8%误选率。做客服Agent的可以参考。
12:17
12:17Harrison Chase@hwchase17
LangGraph Studio 能对失败的 agent 运行做原样重放。用户在重放时替换任意一个组件,再以相同 trace 重跑。LangGraph Studio 会自动生成新旧运行间的 diff,帮助定位失败原因。该功能来自 LangChain 创始人的推文演示,尚无官方教程。
推荐理由:LangChain 创始人在推上演示了 LangGraph Studio 的调试技巧:失败运行能重放和对比,比重新跑一遍省事多了。
11:53
11:53官方账号arXiv cs.LG@Yi Yang, Zhennan Chen, Yihong Zhuang, Tiehan Fan, Yinan Chen, Jian Li, Jian Yang, Ying Tai
RoMeRL将轨迹索引效用空间表示为按结果极性和记忆动态分解的固定维度任务记忆状态。在ALFWorld和LifelongAgentBench上,RoMeRL将Cold-Q比率降低80.0%,反馈密度提高约6.0倍。同时维护记忆大小减少84.4%,LLM调用减少21.1%。论文从理论上证明降阶参数化能增加每个效用坐标的平均反馈,代码已开源。
推荐理由:这论文把智能体记忆里反馈分散和奖励污染的问题一起解决了,Cold-Q降了80%,记忆体积缩了84%,效果很硬核。