08:04Browser Use@browser_use精选76°Browser Use 发布了 0.13.0 beta 版本,该版本用 Rust 从头重写了架构。旧版是为 GPT-4 设计的,而新版针对当前最先进的模型进行了优化。新架构包括自定义 LLM 和浏览器 harness、直接 CDP 控制、完整的浏览器动作空间以及自我故障恢复能力。核心变化是让模型拥有完整的浏览器控制权,而不是预定义的动作空间,从而大幅提升任务完成可靠性。AI产品Browser UseRust浏览器自动化1 个信源在谈事件专题推荐理由:Browser Use 用 Rust 重写后,解决了旧版预定义动作空间导致模型失败不知原因的痛点,做浏览器自动化或 AI 代理的开发者可以直接升级体验更可靠的执行。原文稍后读已读值得跟进有用关注 Browser Use
04:41kimi_moonshot@kimi_moonshot78°Kimi Work 是一款桌面端本地 AI 智能体,支持最多 300 个 AI 代理并行运行。它通过 WebBridge 扩展可操控浏览器完成搜索、点击等任务,内置金融数据工具(Yahoo Finance、世界银行),无需复杂 API 配置。还具备记忆系统,能记录用户偏好和上下文,提升个性化体验。目前支持 macOS(Apple Silicon)和 Windows,可直接下载试用。AI产品智能体本地部署金融工具7 个信源在谈事件专题推荐理由:本地运行 300 个 AI 代理并行工作,解决了云端依赖和效率瓶颈,做自动化办公或金融分析的团队可以直接上手试试。原文稍后读已读值得跟进有用关注 智能体
05:43Browser Use@browser_usebrowser_use 正在测试新的云浏览器接口 browser-wall,该接口允许一个 CDP URL 控制所有云浏览器,并在不到一秒内启动多个浏览器。所有浏览器都预加载了配置文件和代理,以绕过身份验证和反机器人机制。该工具旨在简化多浏览器自动化任务,如并行测试、数据采集等。目前正在测试阶段,邀请用户分享使用场景。AI产品浏览器自动化云浏览器browser_use推荐理由:做浏览器自动化或爬虫的开发者可以关注,一个接口控制多个浏览器能大幅提升效率,建议试试这个新工具。原文稍后读已读值得跟进有用关注 浏览器自动化
10:58官方账号阿里通义 Qwen@Alibaba_Qwen阿里巴巴 Qwen 团队在 Twitter 上发布了第三个演示 Demo3,展示其 Browser Agent 能力。该 Agent 能够自主操作浏览器,执行网页任务。视频演示了 Agent 如何理解用户指令并完成浏览器交互。这一进展表明 Qwen 在智能体领域持续推进,为自动化浏览器操作提供了新方案。目前该推文获得 32 个点赞和 8174 次查看。AI产品QwenBrowser Agent智能体推荐理由:做浏览器自动化和智能体开发的团队值得关注——Qwen 的 Browser Agent 展示了端到端操作能力,可以直接参考其实现思路。原文稍后读已读值得跟进有用关注 Qwen
10:04Browser Use@browser_useMinimax M3 模型在 BU Bench 基准测试中取得了显著进步,相比之前版本提升了 26%。该测试使用 browsercode 方法评估模型在浏览器自动化任务上的表现。目前 M3 的性能已与 Claude 4.6-sonnet 和 Gemini 3.5 flash 等主流模型持平。这一结果表明 Minimax 在浏览器智能体领域取得了重要突破,为未来进一步优化奠定了基础。AI模型Minimax M3BU Bench浏览器自动化6 个信源在谈事件专题推荐理由:做浏览器自动化或智能体开发的团队值得关注——Minimax M3 用 26% 的提升证明自己已跻身第一梯队,可以直接拿来对比测试。原文稍后读已读值得跟进有用关注 Minimax M3
18:16Browser Use@browser_useBrowser Harness 推出新功能,支持 Claude Code 通过 Opus 4.8 模型直接操控浏览器。用户只需一条命令即可安装并开始自动化任何网站。该工具简化了浏览器自动化流程,降低了使用门槛,适合需要网页自动化的开发者和团队。AI产品浏览器自动化Claude CodeOpus 4.86 个信源在谈事件专题推荐理由:做网页自动化的开发者终于有了更简单的方案——一条命令就能让 Claude Code 操控浏览器,建议试试看。原文稍后读已读值得跟进有用关注 浏览器自动化
18:15Browser Use@browser_useBrowser Use 推出了 Terminal 版本,让用户可以直接从命令行运行浏览器自动化任务。该工具支持 CLI 操作、连接 Codex 认证,并能控制真实的 Chrome 浏览器。用户可以通过简单的命令让浏览器自动执行购物等复杂操作,无需编写代码或手动操作。这为开发者提供了一种更高效、更灵活的浏览器自动化方式,尤其适合需要批量处理网页任务的场景。AI产品浏览器自动化CLI工具智能体推荐理由:做自动化脚本或需要批量处理网页任务的开发者,现在可以直接在终端里控制浏览器,省去写复杂代码的麻烦,值得一试。原文稍后读已读值得跟进有用关注 浏览器自动化
09:18shao__meng@shao__meng83°Anthropic 在宣布 H 轮 650 亿美金融资当天,发布了 Claude Opus 4.8。该模型在编码、Agent 任务和知识工作方面显著提升,SWE-Bench Pro 达到 69.2%,Terminal-Bench 2.1 为 74.6%。关键改进包括更诚实的自我监控(误判减少 4 倍)、更稳定的 Agent 协作质量,以及计算机/浏览器 Agent 能力提升(OSWorld-Verified 83.4%)。同时引入 Claude Code Dynamic Workflows,支持从单 Agent 到规划、并行、验证的协作模式。定价不变,即日可用。AI模型Claude Opus 4.8推理模型Agent/智能体10 个信源在谈事件专题推荐理由:做复杂编码、Agent 和浏览器自动化的团队可以直接升级——Opus 4.8 在诚实度和任务完成率上都有实质提升,且价格不变,值得立即试用。原文稍后读已读值得跟进有用关注 Claude Opus 4.8
10:02shao__meng@shao__meng76°微软开源了 Webwright,一个终端原生的 Web Agent 框架,核心设计是“代码即动作”——让 LLM 直接编写 Playwright 脚本,将网页操作转化为可运行的 Python 程序。该框架在 Online-Mind2Web 和 Odysseys 基准测试中达到 SOTA 水平,架构极简,仅约 1000 行代码,无隐藏编排层。Webwright 已集成 Claude Code 和 OpenAI Codex 插件,支持任务完成后自动渲染为 HTML 应用(Task2UI 模式)。其脚本可复用、可审计,适合需要稳定浏览器自动化的开发者和团队。AI产品Web Agent浏览器自动化Playwright10 个信源在谈事件专题推荐理由:Webwright 用代码即动作的思路解决了传统 Web Agent 每次依赖 LLM 判断的低效问题,做浏览器自动化或 RPA 的开发者可以直接用 Playwright 脚本复用成果,值得一试。原文稍后读已读值得跟进有用关注 Web Agent
23:34Geek@geekbb78°Browser-use 团队推出了一款基于 Rust 编写的终端 TUI 工具,用户只需用自然语言描述任务,工具即可自动控制浏览器完成操作。该工具自研了 LLM 引擎,并利用 Chrome 的 CDP 协议实现浏览器控制。支持三种运行模式:使用用户登录态的 Chrome、无头浏览器或 Browser Use 云端。这一工具大幅降低了浏览器自动化的门槛,让非技术人员也能通过简单指令完成网页操作。AI产品Browser-useRustTUI3 个信源在谈事件专题推荐理由:做网页自动化或 RPA 的开发者终于有了一个自然语言驱动的终端工具,不用写脚本就能控制浏览器,值得直接上手试试。原文稍后读已读值得跟进有用关注 Browser-use
07:06Browser Use@browser_useBrowser Use 团队发布了用 Rust 编写的终端 UI 和浏览器自动化工具 Browser Use Terminal。它直接通过 Chrome DevTools Protocol 控制浏览器,支持 GPT、Claude、Kimi、GLM、Qwen、DeepSeek 等多种 LLM。相比原 Browser Harness,速度提升 2 倍、成本降低一半,且完全开源。用户可以在终端中实时观察、暂停、恢复自动化任务,适合处理繁琐的网页操作。AI产品浏览器自动化RustTUI2 个信源在谈事件专题推荐理由:如果你经常在浏览器里做重复性操作(填表、爬数据、管理权限),这个 Rust 写的 TUI 工具比同类方案快 2 倍还便宜一半,而且支持多种主流 LLM,值得直接上手试试。原文稍后读已读值得跟进有用关注 浏览器自动化
07:27Browser Use@browser_useBrowser Use 团队宣布正在开发全新的浏览器基础设施,旨在提升代理、爬虫和自动化任务的运行性能与成本效益。新基础设施包括 Chromium 分支、Firecracker 分支、自定义内核以及无头模式,目标是实现更快的速度和更好的性价比。团队表示,这些改进将很快惠及用户,并发布了性能对比图表。AI产品浏览器自动化基础设施性能优化推荐理由:做浏览器自动化、爬虫或 AI 代理的开发者,这次基础设施升级直接关系到你的任务速度和成本,值得关注即将到来的变化。原文稍后读已读值得跟进有用关注 浏览器自动化
12:41Browser Use@browser_useBrowser Skills 是一个开放的浏览器技能目录,旨在为所有 AI 智能体提供快速使用任意网站的能力。该目录支持社区贡献,技能会随着更多人参与而不断改进。用户可以通过 browser-harness 添加自己的技能,只需一个提示即可设置。该项目解决了智能体在浏览器中高效操作网站的痛点,让开发者可以复用和共享最佳实践。目前已在 X 上发布,获得初步关注。AI产品智能体浏览器自动化开源/仓库推荐理由:做 AI 智能体或自动化工具的开发者终于有了一个共享浏览器技能的开放目录,不用重复造轮子,直接调用社区优化的技能就能快速上手,值得一试。原文稍后读已读值得跟进有用关注 智能体
09:29shao__meng@shao__meng83°Chrome DevTools for Agents 1.0 正式发布,为 AI Agent 提供在真实浏览器中观察行为、检查输出的能力。它支持 MCP server、CLI 和 Agent skills 三种接入方式,并开放了七个核心能力,包括自动化质量审计、真实用户环境模拟、Chrome 扩展调试、WebMCP 工具调试、内存泄漏检测、会话接管以及第三方工具状态暴露。该工具让 Agent 能“看见浏览器”,显著降低集成门槛,提升调试效率。对于开发 AI Agent 或需要自动化浏览器操作的团队,这是一个重要的基础设施更新。AI产品Chrome DevToolsAI AgentMCP/工具推荐理由:做 Agent 开发或浏览器自动化的团队终于有了官方调试工具——Chrome DevTools 直接开放给 Agent,省去自己造轮子的麻烦,建议直接接入试试。原文稍后读已读值得跟进有用关注 Chrome DevTools
09:59官方账号arXiv cs.AI@William Lugoloobi, Samuelle Marro, Jabez Magomere, Joss Wright, Chris Russell精选研究人员发现,基于LLM的浏览器代理在网页上执行任务时,其操作序列和交互时间可以被被动JavaScript追踪器捕获,从而以高达96%的F1分数识别出底层模型。该研究覆盖了14个前沿LLM和四个网页环境,包括信息检索和购物任务。攻击者可以利用此漏洞针对已知模型漏洞发起定向攻击。虽然注入随机时间延迟可以降低分类器性能,但重新训练后仍能恢复大部分识别能力。研究团队已发布相关工具和标注数据集。论文LLM代理安全/隐私指纹识别推荐理由:这项研究揭示了LLM代理的一个重大安全风险——网站可以被动识别你的AI模型,做AI安全和隐私保护的团队值得关注,建议开发者检查自己的代理是否容易通过UI痕迹被指纹识别。原文稍后读已读值得跟进有用关注 LLM代理
17:19官方一手歸藏(guizang.ai)@op7418AI编程助手Codex昨日更新,新增内置的谷歌浏览器插件,使其能够直接控制用户的Chrome或任何基于Chromium的浏览器执行任务。该插件支持后台跨浏览器页面并行工作,用户可以同时启动多个子Agent操作不同网页,且不影响正常浏览器使用。安装过程简单,只需在Codex插件库中找到Chrome插件并按照引导安装即可。该功能已在Mac和Windows上可用,极大提升了自动化任务处理的灵活性和效率。AI产品Codex浏览器自动化并行任务推荐理由:对于AI编程和自动化领域从业者,这一更新意味着Codex从代码辅助扩展到了浏览器自动化,增强了其在网页交互型任务中的应用潜力,值得关注其后续对工作流集成的影响。原文稍后读已读值得跟进有用关注 Codex