11:59shao__meng@shao__meng精选OpenAI、AWS、Cursor、GitHub、VS Code和Vercel联合推出Agent Plugins开放标准,将Agent Skills和MCP服务器配置打包为跨客户端可移植插件。Anthropic未参与该标准,AGENTS.md标准同样未被其采纳,Claude Code至今仍使用CLAUDE.md。相比之下,Anthropic自己发起的MCP和Agent Skills已成为各Agent客户端通用标准。目前Agent Plugins和AGENTS.md的通用范围仍排除了Claude Code,跨Agent通用尚未实现。行业AnthropicClaude CodeMCP10 个信源在谈事件专题推荐理由:Anthropic没参加Agent Plugins标准,Claude Code也不用AGENTS.md,但自家MCP却成了通用标准。生态割裂得很真实。原文稍后读已读值得跟进有用关注 Anthropic
02:45向阳乔木@vista8用户实测bb Agent框架,安装后无需任何配置即可自动识别本机装有的Codex cli、Grok Build cli、Claude Code cli和PI Agent。该框架支持在多个模型之间自由切换,官网宣称其IDE具备“自进化”能力。用户对产品经理的设计表示认可。AI产品bbClaude CodeCodex推荐理由:朋友,bb这个Agent框架装完就能自动认出你电脑里的Codex、Claude Code这些CLI,模型随便切,连设置都不用,有点东西。原文稍后读已读值得跟进有用关注 bb
01:41官方账号Decoder@Matthias BastianComposio在30个真实任务上测试了DeepSeek V4 Flash在四个agent框架中的表现。各框架成功率相近,但成本相差近3倍。OpenCode每任务成本最低,为$0.073,而Claude Code高达$0.195。Claude Code使用最少的工具调用和输出token,但价格最高。框架选择主要取决于价格和速度。AI产品Claude CodeOpenCodeDeepSeek V4 Flash9 个信源在谈事件专题推荐理由:实测四个框架,OpenCode每任务只要7美分,Claude Code要19美分但速度最快。想省钱选OpenCode,追求速度就选Claude Code。原文稍后读已读值得跟进有用关注 Claude Code
00:30官方一手AWS Machine Learning Blog@Zaid Barkat精选AWS 博客介绍了如何将 Claude Code 在 Amazon Bedrock 上的推理限制在单一 AWS 区域(伦敦)内,以满足受监管客户的数据驻留要求。方案有两种:使用应用推理配置文件或 Mantle 端点,并搭配 IAM 区域条件。文章还演示了如何通过 AWS CloudTrail 验证合规性。技巧Claude CodeAmazon BedrockAWS推荐理由:如果你的企业有数据必须留在某个 AWS 区域的要求,这篇教你用两种方法把 Claude Code 锁死在单区域,还能用 CloudTrail 查合规。原文稍后读已读值得跟进有用关注 Claude Code
22:43Gary Marcus@GaryMarcus精选神经科学家Gary Marcus发推称,对神经符号AI困惑的人应读François Chollet的观点。Chollet提出,推理时运行的百万行代码"harness",编排数千次神经网络调用,就是神经符号架构的定义。Marcus称这是对他长期主张的彻底验证,并列举了自己关于Claude Code、o3和Grok 4的文章。行业神经符号AIGary MarcusFrançois Chollet推荐理由:Chollet一句话把神经符号AI说透了:推理时用大段代码调神经网络就是。Marcus狂喜:我早说了。原文稍后读已读值得跟进有用关注 神经符号AI
22:02Weaviate@weaviate_io精选Weaviate 数据库现已原生支持 MCP 协议。Claude Code、Cursor、VS Code 等客户端可直接连接其 /v1/mcp 端点,与 REST API 同端口,无需额外部署 MCP 服务。该服务提供四个工具:查看集合配置、列出租户、BM25+向量混合查询、插入或更新对象。原有认证和工具级 RBAC 仍生效,MCP 服务与写权限可独立开关,运行时切换无需重启集群。AI产品WeaviateMCPClaude Code10 个信源在谈事件专题推荐理由:Weaviate 直接支持 MCP 了,Claude Code 不用额外搭服务就能连数据库查数据、改数据,挺方便。原文稍后读已读值得跟进有用关注 Weaviate
12:00shao__meng@shao__meng72°Matt Pocock 的 Skills 库发布 v1.2,该仓库现有 205K stars,位列 GitHub 史上星标数第 19。更新新增 /wizard、/to-questionnaire、/wait-what 三个技能:/wizard 将人工操作步骤转为交互式 bash 脚本,/to-questionnaire 生成可转发的 Markdown 问卷,/wait-what 用 ASD-STE100 简化模型输出。分发渠道扩展为 Claude 官方插件市场和 Codex(每个 SKILL.md 附带 agents/openai.yaml)。原有 /grilling 改为分轮提问,/prototype 改为单一 HTML 文件并保留为运行证据。skills.sh 下载量已达 1350 万次。技巧Matt PocockClaude CodeCodex10 个信源在谈事件专题推荐理由:搞 AI 编程的朋友注意,Skills 库更新到 1.2,新技能能自动生成引导脚本,还能从 Claude 插件商店直接装,好用多了。原文稍后读已读值得跟进有用关注 Matt Pocock
11:13官方一手arXiv: OpenAI@Sabrina Haque, Christoph Csallner一项针对 GitHub Copilot、Cursor、Claude Code、OpenAI Codex 和 OpenCode 五类 AI 开发者工具的研究,从 2652 个候选讨论中识别出 600 个视觉可访问性问题报告。研究通过三模型集成和分层人工检查筛选,归纳出屏幕阅读器障碍、视觉呈现与对比度问题、AI 特定界面可读性等三类主要问题。不同生态系统的编辑器、终端、聊天、diff 和智能体界面中,可访问性问题的分布存在明显差异。基于 GitHub 的生态系统中,维护者参与度和关闭流程也影响问题的记录与修复。论文GitHub CopilotCursorClaude Code10 个信源在谈事件专题推荐理由:论文分析了五种AI编程工具的可访问性问题,发现Copilot、Cursor等对视觉障碍者的支持差异明显,做无障碍开发的人值得看。原文稍后读已读值得跟进有用关注 GitHub Copilot
09:56官方一手Claude Code: GitHub Releases@ashwin-ant精选Claude Code v2.1.223 修复了 Bash 权限绕过,利用制表符或不可见 Unicode 混入的命令无法再隐藏。工作流脚本通过动态 import() 逃逸沙箱的问题也被封堵。/review 命令现在改为 /code-review 的别名,并支持指定审查级别(如 ultra)。云会话新增 /teleport 提示,可用 claude --teleport <session id> 在本地继续。AI产品Claude CodeAnthropicAI安全10 个信源在谈事件专题推荐理由:Claude Code 新版重点堵了安全漏洞,权限审核更严了。云会话想转本地继续,敲 claude --teleport 就能接上。原文稍后读已读值得跟进有用关注 Claude Code
08:47官方一手marktechpost@Asif RazzaqSkillOpt 的核心结果不只有 52/52,Section 4.3 显示导出的 best_skill.md 能在未训练过的环境里继续工作。一个用 Codex 训练的 SpreadsheetBench 技能,让 Claude Code 从 22.1 提升到 81.8,略高于该环境自己训练技能得到的 80.4。迁移保留率随任务类型差异明显:电子表格任务达 102%,数学任务只有 10%。AI模型SkillOptMicrosoftCodex推荐理由:别只盯 52/52,微软把 Codex 练好的技能搬到 Claude Code,电子表格直接涨到 81.8,比自己练还高一点;不过数学任务保留率只有 10%。原文稍后读已读值得跟进有用关注 SkillOpt
07:18IT之家(博客/媒体)82°Meta于8月6日以测试版推出首个编程AI智能体工具Muse Code,直接对标Anthropic的Claude Code和OpenAI的Codex。该工具由Meta首席AI官汪滔(Alexandr Wang)领导的团队开发,一条命令即可安装并处理规划、编码、验证等完整软件工程任务。与Muse Code同步训练和开发的Muse Spark 1.2模型提升了整体编程性能。定价方面,Muse Code按量付费为每100万Tokens输入1.25美元、输出4.25美元;contributor tier订阅价格可低至按量付费的十分之一以下,但需同意Meta使用第三方数据改进模型。Meta还开始接受零数据保留请求,不保留开发者数据用于模型改进。AI产品Muse CodeMetaCodex10 个信源在谈事件专题推荐理由:Meta出编程工具Muse Code,一条命令跑完整工程,价格低于Codex,支持零数据保留。原文稍后读已读值得跟进有用关注 Muse Code
05:20官方账号Simon Willison@simonwSimon Willison在推特公开了他用于Claude Code for web的提示词,目标是Fable 5。该提示词结合了四年前推文中的截图,构成多模态输入。Claude Code for web是Anthropic推出的浏览器端编码工具,支持图像与文本混合。此示例展示了如何用历史截图约束模型输出。技巧Claude CodeSimon Willison提示词工程10 个信源在谈事件专题推荐理由:想学怎么用Claude Code for web处理带截图的复杂任务?Simon直接把他用的提示词贴出来了,照着试就行。原文稍后读已读值得跟进有用关注 Claude Code
18:29IT之家(博客/媒体)微软执行副总裁杰伊·帕里克向员工发信,宣布将像管理关键资源一样严格管理Token支出,并设置内部AI用量上限。为提高Token利用率,微软将价格较低的OpenAI GPT-5.6设为内部默认模型,并计划自2026年7月起为各部门设定AI Token预算目标。目前部分工程师每月Token支出达数百至数千美元,微软暂未公布具体上限。此前5月,微软已取消大部分内部Claude Code许可证,要求工程师改用GitHub Copilot CLI。类似问题也波及Uber,其员工四个月烧光2026年全年AI编程Token预算,而亚马逊一个Claude Sonnet系统耗资180万美元。行业微软GPT-5.6GitHub Copilot10 个信源在谈事件专题推荐理由:微软自己都嫌员工AI用太猛,开始限Token了。GPT-5.6设为默认,Uber四个月烧光全年预算,看看大厂怎么降本。原文稍后读已读值得跟进有用关注 微软
10:11Geek@geekbb75°OpenRouter 推出 Ori Harness,一个用来配置编程工具接入 OpenRouter 的新功能。它能开箱即用地设置 Codex、Claude Code、OpenCode 和 Hermes,针对每种工具做了单独优化。用户可以通过它让这些编程工具使用 OpenRouter 上的任意模型。AI产品OpenRouterOri HarnessClaude Code1 个信源在谈事件专题推荐理由:OpenRouter 出了个 Ori Harness,能一键把 Claude Code、Codex 这些切换到它家模型,不用自己改配置了。原文稍后读已读值得跟进有用关注 OpenRouter
03:13OpenRouter@OpenRouterAIOpenRouter推出Ori Harness,可自动配置Codex、Claude Code、OpenCode和Hermes四种编程工具接入其平台。每个工具的设置都经过单独优化,并支持任意模型。用户无需手动编写配置文件即可完成连接。AI产品OpenRouterOri HarnessCodex1 个信源在谈事件专题推荐理由:OpenRouter出了个配置工具,能让Codex、Claude Code这些直接连上它的模型,不用自己折腾配置。原文稍后读已读值得跟进有用关注 OpenRouter
03:09OpenRouter@OpenRouterAIOpenRouter推出ori功能,当工具行为因模型而异时,它会自动调整配置。例如在Claude Code中,一个设置就能让系统提示词减少近一半,同时缩短任务长度并降低成本。该设置在通过OpenRouter网关调用时默认并未开启。AI产品OpenRouterClaude Codeori推荐理由:OpenRouter出了个ori,能自动帮你调好Claude Code的设置,提示词砍半,任务更快更省钱,不用自己折腾了。原文稍后读已读值得跟进有用关注 OpenRouter
02:17elvis@omarsar0Not Diamond Code 是一款面向长周期编码智能体的模型路由器,原生支持 Claude Code。它在每轮会话前自动选择模型和推理强度,并通过隐私保护的本地代理运行,请求仍由用户自己的网关执行。官方基准显示,其效果接近 Opus 4.8 Xhigh,成本降低 39%-61%。Not Diamond 还称,这种路由方式可在不影响质量的情况下将编码成本削减 20%-65%。AI产品Not DiamondClaude Code模型路由推荐理由:Claude Code 用户想省钱?这个路由器每步自动挑模型和推理档,官方说质量接近 Opus 4.8 Xhigh,成本能降四到六成。原文稍后读已读值得跟进有用关注 Not Diamond
01:39宝玉@dotey博主dotey推荐了一份Harness源码学习列表,其中重点提到pi-mono项目。他认为与其把每个项目都浏览一遍,不如彻底搞透pi-mono。作者还指出该列表缺少近日泄露的Claude Code源码,认为它是一个重量级补充。技巧pi-monoClaude CodeHarness推荐理由:dotey说这有份harness源码清单,pi-mono最值得啃透,比全看一遍强。他还吐槽漏了Claude Code泄漏源码,挺可惜。原文稍后读已读值得跟进有用关注 pi-mono
00:57Julien Chaumond@julien_cNot Diamond 发布 Code,号称世界最强大的智能模型路由器,专为长时程编码代理设计。该路由兼容 Claude Code 等网关或框架,可为每个步骤选择最佳模型和推理力度。官方称其能将成本降低 20-65%,同时不影响输出质量。AI产品Not DiamondClaude Code模型路由推荐理由:新出的 Not Diamond Code 能在编码代理跑每一步时自动选最合适的模型,省 20-65% 的钱,效果还不打折。原文稍后读已读值得跟进有用关注 Not Diamond
00:35掘金本周最热@老王以为文章用公式"Agent=决策引擎+信息视野+执行通道"解释AI Agent的本质。介绍了2022年提出的ReAct循环,让模型交替进行思考与行动。提到Claude Code、千问、豆包等日常工具都属于Agent形态。用"上海到北京3天旅行"的伪代码展示轨迹的消息序列结构。对比了Agent与聊天机器人的差异,强调其能调用工具并循环改进。技巧智能体ReActClaude Code推荐理由:这篇用公式加旅行规划案例拆解AI Agent,比空谈概念的文章实在,看完能跟人讲清楚。原文稍后读已读值得跟进有用关注 智能体
22:29向阳乔木@vista8开源项目 qiaomu-meta-skill 是一个元 Skill,能自动生成新的 Skill。它由 joeseesun 在姚老师基于泄露的 Claude Code 源码创作的初版上迭代而来,并借鉴了 OpenAI、Gemini 官方 Skill 的最佳实践。相比 Anthropic 官方 skill-creator,它在触发率、准确性和格式校验上表现更好。生成时会先检索 skill.sh 和 skillsmp.com 的热门 Skill,再产出结果。支持发布到 GitHub、生成 npx 安装指令,安装命令为 npx skills add joeseesun/qiaomu-meta-skill。AI产品Claude CodeAnthropic元Skill10 个信源在谈事件专题推荐理由:这个元Skill比官方skill-creator好用,能自动搜skill.sh的热门Skill再生成,还能一键发GitHub,装一下试试。原文稍后读已读值得跟进有用关注 Claude Code
10:16官方一手Claude Code: GitHub Releases@ashwin-antClaude Code v2.1.221 在 VS Code 端新增 Focus 视图,能把工具活动折叠成逐轮摘要,并显示实时运行中的工具指示器,可用 Ctrl+Alt+F 切换。Linux 和 WSL 下新增 mask 沙箱凭证模式,命令只读取哨兵副本,出站时由代理替换真实值。修复了 zsh 在 [[ ]] 正则条件中执行隐藏命令、绕过 Bash 工具权限检查的问题,受影响命令会重新请求授权。还修复了 Windows 路径含引号时 PowerShell 权限判断错误、--mcp-config 在 -p 模式首轮前未连接、WebSearch 在高 effort 下关闭思考时返回 400 等多项缺陷。Vim 模式下 yank 寄存器不再因对话框、历史搜索和 transcript 视图被清空。AI产品Claude CodeVSCodeMCP推荐理由:Claude Code 这版修了 zsh 权限绕过和 MCP 连接坑,VS Code 用户建议升级。原文稍后读已读值得跟进有用关注 Claude Code
08:29宝玉@dotey宝玉分享跨Agent session的协作技巧:在Claude Code中用Fable 5写技术方案并反复Review,再交给Codex配合/goal执行。他建议用/compact压缩上下文代替新开Session,只在关系不大的任务才新开。旧迁移任务因未设验收标准而交付质量差;加上“UI像素与原版完全一致”的标准后,Codex每一步都会截图对比像素差异,直到达标。技巧Claude CodeCodex智能体推荐理由:看看宝玉怎么让Codex干活:先写文档再给目标,卡死验收标准,它就会老老实实逐像素核对。原文稍后读已读值得跟进有用关注 Claude Code
11:43Gary Marcus@GaryMarcus75°Gary Marcus在推文中称,2017年以来除规模扩展外,最大突破是将基础模型扩展为整合工具和代码解释器的系统,例如Claude Code。João Mendonça则反驳,LLM领域已有9年没有突破,自2017年6月《Attention Is All You Need》和2017年1月应用稀疏MoE之后,架构没有质变。这场辩论的双方都承认,Claude Code是工具化系统路线的代表产品。AI模型Claude Code智能体Transformer推荐理由:Gary说最大突破是模型加工具和代码解释器,像Claude Code;另有人说9年没真突破。原文稍后读已读值得跟进有用关注 Claude Code
10:16小互@imxiaohu75°Anthropic 高管 Boris 在 X 上透露,公司内部平均 90% 的代码由 Claude Code 编写,他本人自 2024 年 11 月起实现 100% 由 Claude Code 写代码。他还提出,前端、后端、产品设计的传统分工已过时,团队实际分化为原型师、构建者、维护者、扩展者和收尾人五种角色。其中扩展者负责将跑通的产品放大 10 倍到 100 倍,目前在 Anthropic 最抢手。行业Claude CodeAnthropic编程助手9 个信源在谈事件专题推荐理由:Boris 说 Anthropic 九成代码都是 Claude Code 写的,他还把团队分成了五种角色,你可以看看自己的位置对应哪种。原文稍后读已读值得跟进有用关注 Claude Code
22:53Geek@geekbbMonet 是一款面向 Claude Code 的桌面工作台,将分散在终端窗口的会话集中到统一界面。它提供并行会话列与权限审批卡片,可同时指挥多个任务。赛马模式支持对比不同模型的输出,会话中切换渠道与模型不会丢失上下文。项目已发布到 GitHub。AI产品MonetClaude Code编程助手推荐理由:Monet 把 Claude Code 搬出终端,做成图形工作台,还能赛马对比模型,适合同时跑多个任务的人。原文稍后读已读值得跟进有用关注 Monet
08:44ollama@ollamaDeepSeek-V4-Flash-0731已在Ollama云上线,速度比前一天快2倍以上。该版本显著增强了智能体能力,支持通过ollama run deepseek-v4-flash:0731-cloud调用。用户还可搭配Claude Code使用,命令为ollama launch claude --model deepseek-v4-flash:0731-cloud。AI模型DeepSeek-V4-Flash-0731OllamaClaude Code推荐理由:Ollama云上线了DeepSeek-V4-Flash-0731,速度比昨天快2倍多,还能配合Claude Code用,可以试试。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash-0731
03:17宝玉@doteydotey 认为,为了省上下文而 handoff 新开 Session 的做法已过时,Codex 自身的上下文压缩或 /compact 已足够。他仍会在跨 Agent 场景用 handoff,例如把 Claude Code 未完成的 session 交给 Codex 继续。他习惯在 Claude Code 里用 Fable 5 写技术方案文档,配合 Codex 的 /goal 执行。他还强调要设严格验收标准,比如迁移任务要求 UI 像素级一致,否则 AI 会偷懒。他引用 Tz_2022 的两步 handoff 方法:任务后用提示词生成摘要,再在新 session 首条消息发给 AI,以省 token。技巧CodexClaude Codehandoff推荐理由:dotey 用实际经验讲清 handoff 和 /compact 怎么选,还给了防偷懒的验收标准,适合用 Codex 做连续任务的。原文稍后读已读值得跟进有用关注 Codex
23:13elvis@omarsar0精选Claude Code原生的Agent Teams在终端关闭后工作状态即消失,团队无法恢复。ATWZ是一个围绕Claude Code构建的文件系统操作层,为每个智能体分配独立的工作目录,存储其工作状态、技能和脚本。团队会定期备份,压缩对话后知识仍然保留,进程结束后可用一条命令恢复整个团队。智能体还能在工作区内互发文档,减少大部分交接提示词的编写。论文Claude CodeATWZ智能体推荐理由:Claude Code多智能体协作总丢状态?ATWZ给每个智能体独立工作区,一条命令恢复整队。原文稍后读已读值得跟进有用关注 Claude Code
21:11shao__meng@shao__meng78°前 Google 工程师 Mihai Maruseac 在入职 OpenAI 6 个月后发文对比两团队:OpenAI 会议少、领导透明,开发速度远超 Google,但基础设施不如 Google 成熟。他观察到 Gemini 3.0 之后近半年没落,Gemini CLI 和 Antigravity 迭代慢,而 Codex 与 Claude Code 几乎日更。他个人工作方式也变了,从逐行重写 AI 代码到信任 Codex 自主完成编码、提交、PR 到上线。行业OpenAIGoogleCodex10 个信源在谈事件专题推荐理由:从 Google 跳 OpenAI 的工程师亲述:Codex 已能自己提 PR 上线,而 Gemini CLI 更新慢到被甩开。原文稍后读已读值得跟进有用关注 OpenAI
17:57官方一手marktechpost@Michal SutterSupabase开源了Apache-2.0许可的基准框架supabase/evals。该框架让Claude Code、Codex和OpenCode在容器化环境中执行真实Supabase任务,例如构建schema、调试Edge Functions、修复RLS策略。评分结合确定性检查与LLM-as-a-judge。AI模型SupabaseEvalsClaude Code1 个信源在谈事件专题推荐理由:Supabase开源Evals,用真实任务评估Claude Code等编码智能体,比普通基准更实战原文稍后读已读值得跟进有用关注 Supabase
17:17AI Will@FinanceYF5精选Claude Code 创作者 Boris Cherny 建议每6个月删除一次 CLAUDE.md、Skills 和 Hooks 配置。他提醒用户,升级到 Opus 5 后,为旧模型写的规则可能从帮助变成限制。通过裸跑,用户能观察模型在没有历史规则时的真实表现。他建议升级后先做一次裸跑测试,结果或许让人意外。技巧Claude CodeOpus 5Boris Cherny4 个信源在谈事件专题推荐理由:Boris Cherny说每半年删掉Claude Code的配置和Skills,让Opus 5裸跑,你会发现旧规则反而碍事。原文稍后读已读值得跟进有用关注 Claude Code
17:16AI Will@FinanceYF5精选Claude Code创建者Boris Cherny在Y Combinator Startup School 2026上建议,不开发Agentic产品的用户每6个月删除一次claude.md文件、skills和hooks。他强调删除后观察模型行为,结果可能出乎意料。Cherny特别指出,对于Opus 5,应彻底删除这些配置,因为新模型可能不再需要旧版本所需的详细指令。该建议来自Y Combinator官方YouTube频道的完整视频。技巧Claude CodeOpus 5Boris Cherny4 个信源在谈事件专题推荐理由:Claude Code作者说,每半年清空配置和技能,模型反而表现更好。Opus 5用户更该试试。原文稍后读已读值得跟进有用关注 Claude Code
17:12AI Will@FinanceYF5有人在 X 平台发布推文,分享了一条 Claude Code 提示词。据称,这条提示词的效果堪比时薪 300 美元的资深工程师。截至统计,该推文仅获得 1 条回复、0 次转发和 161 次浏览。技巧Claude Code提示词工程编程助手推荐理由:有人捡到一条 Claude Code 提示词,据说能顶时薪 300 美金的资深工程师。想看看这提示词什么来头,点进原推吧。原文稍后读已读值得跟进有用关注 Claude Code
14:32ollama@ollamaDeepSeek-V4-Flash-0731 已上线 Ollama 云服务。此次更新显著增强了模型在智能体任务中的表现。用户可运行 ollama run deepseek-v4-flash:0731-cloud 直接使用,也可通过 ollama launch claude --model deepseek-v4-flash:0731-cloud 将其与 Claude Code 集成。AI模型DeepSeek-V4-Flash-0731OllamaClaude Code推荐理由:DeepSeek-V4-Flash-0731 上架 Ollama 云了,agent 能力更强,能直接配合 Claude Code 用,跑一条命令就能体验。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash-0731
11:11shao__meng@shao__meng75°YC 将其内部使用的多人 Agent Harness QM 开源,项目以 MIT 许可证发布在 GitHub 上。QM 已在 YC 的会计、法务、活动运营和工程协作中运行,工具注册表从约 20 个工具增长到 350 多个。核心抽象是“scope”作用域,每个人、Slack 频道和项目房间都有独立的记忆、文件、密钥和沙箱。架构分为无头核心、可替换的 harness(Pi、OpenCode、Codex、Claude Code)、Postgres 持久层和插件化前端。安全模式分为 Strict、Auto 和 Dangerous 三档,默认 Auto 会在外部数据进入模型前做来源标注和筛查。AI产品QMYC多智能体5 个信源在谈事件专题推荐理由:YC 开源内部在用的 QM,按人和频道隔离上下文,可切换 Codex、Claude Code,MIT 许可。原文稍后读已读值得跟进有用关注 QM
05:38elvis@omarsar0精选AgentRadio提出线程、消息、等待提及三种原语,用异步消息传递取代阶段式交接。在SWE-Atlas QnA基准上,单个Claude Code agent(Opus 4.6)解决32.3%任务,四个通过AgentRadio协作的agent解决62.1%,超过单个Opus 4.8的57.2%。按难度分层分析显示增益随任务难度增长,说明收益主要来自中途修正而非并行。论文见arxiv.org/abs/2607.28430。论文AgentRadioClaude CodeOpus 4.8推荐理由:这篇把4个Claude Code用AgentRadio串起来,SWE-Atlas上干到62.1%,比单跑Opus 4.8还高。搞多智能体协作的值得看看。原文稍后读已读值得跟进有用关注 AgentRadio
05:14Paul Graham@paulgSupabase 发布了名为 Evals 的基准测试,用于评估 AI 编码代理在 Supabase 平台上的真实任务完成能力。该基准会运行 Claude Code、Codex 和 Open Code 等代理,并对其结果进行打分。Paul Graham 对此表示赞赏,认为未来所有面向代理的服务都应采用类似机制。AI产品SupabaseClaude CodeCodex1 个信源在谈事件专题推荐理由:Supabase 给 Claude Code、Codex 这些编程代理搞了个真实任务考试,谁更会建应用,看看分数就知道。原文稍后读已读值得跟进有用关注 Supabase
00:08Geek@geekbb精选Surface 是一款用 Rust 编写的本地扫描工具。它能检测本机已安装的 AI 工具、浏览器历史中的 AI 站点,以及 Claude Code、Codex、OpenCode 的转录记录。Surface 会统计这些工具的 token 用量,并按 LiteLLM 公开价格表折算成美元花费。所有数据均在本地处理,不涉及云端上传。AI产品SurfaceClaude CodeCodex2 个信源在谈事件专题推荐理由:装个 Surface 就能扫出本机 AI 工具和花费,连 Claude Code 的 token 都给你算成美元。原文稍后读已读值得跟进有用关注 Surface
23:11Geek@geekbbOpenQ 是一个系统托盘工具,提供统一面板查看 8 个 AI 编程服务的剩余额度。它支持 Claude Code、Codex、Cursor、Copilot、Devin、Grok、OpenRouter、Zai 共 8 款服务。用户可同时看到每个服务的重置时间和预计花费,无需分别打开各平台页面。项目代码托管在 GitHub 的 deviffyy/OpenQ 仓库中。AI产品OpenQClaude CodeCodex2 个信源在谈事件专题推荐理由:装个 OpenQ,系统托盘就能直接看到 Claude Code、Codex、Cursor 这些编程服务还剩多少额度,不用挨个翻页面了。原文稍后读已读值得跟进有用关注 OpenQ