8月21日
05:35
05:35Browser Use@browser_use
Opus 5 和 GPT-5.6 Sol 在浏览器使用基准测试中表现接近。该基准由数百名用户参与,将真实用户任务转化为测试。测试采用原子化、可验证且明确的评估标准。这是目前最好的浏览器智能体基准测试。
推荐理由:Opus 5 和 GPT-5.6 Sol 在一个新浏览器基准上打平了,这个基准是真实用户任务,评估标准很细,看看谁更会上网吧。
7月26日
10:58
6月23日
5月31日
05:09
05:09Ate-a-Pi@svpino
精选
开发者 Santiago 指出当前在浏览器中运行智能体体验糟糕,因为浏览器并非为智能体设计。Ego 团队重新构建了浏览器,支持多智能体并行运行、各自拥有独立空间,并可随时接管或终止。底层基于 Chromium,兼容现有扩展和书签,且不绑定特定助手,可与 Claude Code、Codex、Cursor 等配合使用。
事件专题

推荐理由:Ego 解决了智能体在浏览器中运行时的会话冲突和体验割裂问题,做自动化测试或 AI 工作流的开发者可以直接试试,不用再忍受 hack 式的方案。
5月28日