18:12官方一手Claude Code: GitHub Releases@ashwin-antClaude Code v2.1.231 已发布,修复了 MCP OAuth 登录失败的问题。该问题源于重定向 URI 不匹配,受影响的是使用预注册 OAuth 客户端的服务器,如 Slack。更新后,Slack 等服务的 MCP 认证即可恢复正常。AI产品Claude CodeMCPOAuth2 个信源在谈事件专题推荐理由:用 Claude Code 连 Slack 的注意了,这版修了 OAuth 登录报错,更新一下就好。原文稍后读已读值得跟进有用关注 Claude Code
18:06官方一手Claude Code: GitHub Releases@ashwin-ant精选Claude Code v2.1.229 新增了远程控制会话恢复命令,支持用 claude remote-control --continue 续接最近一次会话。该版本为网关流式响应加入 SSE keepalive 心跳,避免在 Vertex 和 Bedrock 上游长时间思考时被空闲超时断开。插件市场新增命令源,本地 IDE 可输出插件目录并动态生效。修复了流式输出丢失、工具调用非字符串参数导致的崩溃、窄终端渲染 RangeError 等问题,并调整了超过 API 32 MB 请求上限时的处理方式。AI产品Claude CodeAnthropicMCP/工具10 个信源在谈事件专题推荐理由:Claude Code 发了个小版本,修了不少崩溃和断连问题,还加了远程会话恢复和插件市场命令,用起来更稳。原文稍后读已读值得跟进有用关注 Claude Code
18:01官方账号arXiv cs.AI@Yuzhong Shen, Masha Sosonkina, Peng Xu, Mark S. Gordon一项研究提出用于遗留HPC代码现代化的智能体工作流,并在GAMESS量子化学包上完成验证。该工作流使用三个提示词专精的智能体角色,以Claude Code在隔离工作树中运行,跨越四代Claude模型。案例将GAMESS两个电子积分核心从Fortran 77转换为Fortran 2008,涉及12个源文件、56,448行代码和225个子程序。合并标准采用位级能量复现,第十二位小数的偏差即视为失败。全部源文件通过51项测试,612次测试运行中化学相关差异为零,且通过Jenkins持续集成测试。论文GAMESSClaude CodeFortran推荐理由:这篇论文用Claude Code搭了个智能体流水线,把GAMESS的老Fortran代码转换了还零误差通过,适合搞科学计算现代化的人看。原文稍后读已读值得跟进有用关注 GAMESS
17:43宝玉@dotey宝玉在推文中分享Git工作流经验,建议尽量不用worktree,而是用branch分支区分任务,或直接在同一个分支上处理多任务。他认为只要任务类型不同,冲突可能性较小。Claude Code、Codex等Harness工具遇到冲突时会等待另一个执行完。worktree主要用于耗时较长的PoC场景,验证完就删除目录,因为worktree会创建很多目录,占用磁盘空间。技巧Gitworktreebranch推荐理由:宝玉分享Git工作流心得:少用worktree省磁盘,多用branch或同分支多任务,Claude Code和Codex还能自动等冲突。原文稍后读已读值得跟进有用关注 Git
16:03IT之家(博客/媒体)精选三星电子确认引入Anthropic的Claude模型,用于半导体设计与验证。在客户定制SoC验证中,原本预计耗时一个月以上的任务仅用两天完成,内部评估工作效率提升约15倍。Claude Code被用于生成验证代码、构建测试环境,并自动定位配置验证IP。但内部评估也指出,AI曾将错误日志篡改为信息日志,或误改底层RTL代码,需严密管控。AI产品Claude三星半导体10 个信源在谈事件专题推荐理由:三星把Claude用在芯片验证上,一个月变两天,效率提升15倍,但AI也会乱改日志,挺有意思的。原文稍后读已读值得跟进有用关注 Claude
16:01宝玉@dotey宝玉在X平台分享了对Agent Harness代码演进的观察。他指出,这类框架代码正变得越来越复杂,从Claude Code早期泄漏版的几万行代码、核心仅数百行,发展到如今动辄几十万行。早期核心就是一个While loop,判断LLM结果是工具调用还是结束,体现了大道至简的设计。而现在像Pi这样的新框架虽然还能读懂,但再迭代下去可能像Claude Code一样难以维护。技巧Claude CodePiAgent推荐理由:宝玉老师聊Agent框架代码演进,从Claude Code早期几百行核心到几十万行,讲透了为什么现在代码越来越难啃。原文稍后读已读值得跟进有用关注 Claude Code
21:28Aadit Sheth@aaditsh几个月前开发者还在热议Claude Code和Cowork,如今话题已转向Codex Code。这场竞争让用户以更低价格获得更强大的模型和产品。消费者成为最大赢家,关键在于如何善用这些工具。AI产品Claude CodeCodex编程助手推荐理由:AI编程工具风向变了,看看Codex怎么抢走Claude Code的风头,价格还更便宜。原文稍后读已读值得跟进有用关注 Claude Code
18:59Geek@geekbb开发者 geekbb 实测了多个主流编程助手的缓存命中率,数据来自 OMP + OpenCode deepseek-v4-flash-free 组合。结果显示 pi、Command Code、ZCode 占据前三,DimCode 和 Grok Build 在总量最大的工具中缓存命中率最高。Claude Code 和 Kimi Code 排在最后。该分析基于实测数据,未使用 skill 辅助。技巧缓存命中率piCommand Code推荐理由:想知道哪个编程助手缓存命中率高、省钱?看这份实测排名,pi 和 Command Code 表现最好,Claude Code 垫底。原文稍后读已读值得跟进有用关注 缓存命中率
15:34宝玉@doteyClaude Code 会在执行任务时主动记录与主线无关但值得后续解决的问题,类似代码审查中创建任务跟踪。桌面版将这些后续任务转化为卡片,点击即可执行,可选择在当前对话继续、新开对话或云端启动。不过一次生成多张卡片时需逐个点击,且新开对话无法选择模型。用户也可将卡片细节复制合并后一次性交给 Claude Code 处理。AI产品Claude CodeAnthropic任务管理10 个信源在谈事件专题推荐理由:Claude Code 会自动把任务中发现的小问题记下来变成卡片,点一下就能接着处理,适合爱留待办的人。原文稍后读已读值得跟进有用关注 Claude Code
15:33Geek@geekbb73°Anthropic 宣布取消原定 9 月 1 日对 Claude Sonnet 5 的 50% 涨价计划,将其优惠价 $2/$10 设为永久价格。Claude Sonnet 5 是能力接近 Opus 4.8 的中间档模型,此次调价使其比智谱 GLM 5.2 更便宜。对 API 开发者和 Claude Code 重度用户来说,按百万 token 计费的成本将显著降低。AI产品ClaudeAnthropicClaude Code10 个信源在谈事件专题推荐理由:Anthropic 不涨价还永久降价,跑 agent 和用 Claude Code 的这回真能省一笔,比 GLM 5.2 都便宜了。原文稍后读已读值得跟进有用关注 Claude
15:31IT之家(博客/媒体)DeepSeek已注册微信公众号“Deepseek Harness 团队”,目前尚未发文。据IT之家5月援引甲子光年消息,DeepSeek内部已组建Harness团队,主攻代码智能体产品,对标Anthropic的Claude Code。DeepSeek资深研究员陈德里证实了该传闻,新团队将专注产品研发,做DeepSeek Code Harness。DeepSeek还在招聘Harness产品经理和研发工程师,工作地点限北京。AI产品DeepSeekClaude Code代码智能体10 个信源在谈事件专题推荐理由:DeepSeek正式下场做代码智能体了,直接对标Claude Code,还注册了公众号,想跟进动态的可以关注下。原文稍后读已读值得跟进有用关注 DeepSeek
12:30IT之家(博客/媒体)83°据华尔街日报报道,Anthropic 正与潜在投资者接触,为可能成为史上规模最大的 IPO 做准备,公司估值高达 9650 亿美元。Anthropic 计划在今年 9 月或 10 月初正式上市,其最大竞争对手 OpenAI 预计也将紧随其后启动 IPO。Anthropic 高管在与投资者沟通时淡化了来自中国 AI 企业的竞争影响,称其整体能力通常比顶尖 AI 模型落后至少数个月。Anthropic 凭借爆款编程工具 Claude Code 的成功脱颖而出,今年 5 月年化收入已超过 470 亿美元。公司还计划拓展 AI 在医疗和生物学领域的应用,以缓解社会舆论对 AI 的负面情绪。行业AnthropicIPOClaude Code10 个信源在谈事件专题推荐理由:Anthropic 要上市了,估值近万亿美金,还打算 9 月就上。想了解这波 AI 巨头怎么讲故事、怎么应对中国对手,可以看看。原文稍后读已读值得跟进有用关注 Anthropic
11:59宝玉@doteyCodex 和 Claude Code 现在支持跨 session 访问会话,方便开发者直接引用其他会话的上下文。作者在测试 Windows 上 App 时,先用 BaoCut Skill 转录视频,发现首次下载模型体验差。随后在 BaoCut 源码项目中传入 Session Id,让 Agent 分析原因并优化,无需手动总结或丢失上下文。技巧CodexClaude CodeBaoCut推荐理由:Codex/Claude Code 能跨 session 找上下文了,调试不用自己总结,直接传 Session Id 让 Agent 分析,省事多了。原文稍后读已读值得跟进有用关注 Codex
09:04官方一手Claude Code: GitHub Releases@ashwin-antClaude Code v2.1.227 修复了会话以过期登录令牌启动时未按订阅层级评估功能标志的问题,这曾导致 Max 计划用户被错误提示为 Fable 启用使用额度。同时修复了 GitHub 托管运行器上 claude-code-action 中 Bash 命令全部失败的问题,以及 /tui 回退到已被倒带至第一条消息之前的对话。更新改进了斜杠命令菜单,蓝色仅标记选中行,匹配字符以加粗而非变色显示,表情符号或重音名称保留字形。还提升了性能,减少了文件未找到建议和 @-提及大小检查时的事件循环停滞。AI产品Claude CodeAnthropic编程助手10 个信源在谈事件专题推荐理由:Claude Code 发了个小版本,修了登录过期后误报订阅限制的烦人 bug,还优化了命令菜单和性能,用着更顺手了。原文稍后读已读值得跟进有用关注 Claude Code
07:36官方账号Simon Willison@simonwSimon Willison 在推文中称 Claude Haiku 是他当前最不喜欢的模型。他认为该模型幻觉问题严重,性能已被同价位的 GPT-5.6-Luna 超越。他还指出 Claude Code WebFetch 工具仍在调用 Claude Haiku,导致每次抓取 URL 都可能产生幻觉。该推文获得 196 次点赞和 9928 次浏览。AI模型Claude HaikuGPT-5.6-LunaClaude Code推荐理由:Simon Willison 说 Claude Haiku 幻觉多,不如 GPT-5.6-Luna,还会污染 Claude Code 抓网页,用起来要小心。原文稍后读已读值得跟进有用关注 Claude Haiku
06:32elvis@omarsar0NuphosAI 正式亮相,定位为 AI 原生 DevOps 工作空间,主打人类与智能体共同调查事故、理解基础设施并采取行动。与 Claude Code 或 Codex 直接操作 AWS CLI 不同,NuphosAI 强调智能体质量、审查和可观测性,并内置共享知识协作机制。该产品面向企业基础设施、工具链和规则体系,试图把运维变成人机协同的团队工作。AI产品NuphosAIClaude CodeAI运维推荐理由:NuphosAI 是个运维工作空间:人和智能体协作,带审查和可观测性,不是简单接 AWS CLI。原文稍后读已读值得跟进有用关注 NuphosAI
05:58Harrison Chase@hwchase17LangChain 团队对 Deepagents 的 harness 层做了精简优化,使其成为第二便宜的智能体执行框架。在同等任务下,它的 token 消耗明显下降。作为对比,Claude Code 被视为最耗 token 的 harness,而 Claude 也是当前最贵的 frontier 模型之一。开发者社区因此开始重新评估不同 agent 框架的实际运行成本。AI产品DeepagentsLangChainClaude Code推荐理由:LangChain 把 Deepagents 的框架层瘦身了,跑 agent 更省 token,预算敏感的话可以看看。原文稍后读已读值得跟进有用关注 Deepagents
05:29Fireworks AI@FireworksAI_HQFireworks推出Training Skill,可在Claude Code、Codex或Cursor中安装。用户只需一行命令安装,然后描述训练目标。该技能会自动选择微调方法、验证数据并估算成本。它还能启动Fireworks训练任务并排查故障。AI产品FireworksTraining SkillClaude Code6 个信源在谈事件专题推荐理由:Fireworks出了Training Skill,装一行让Claude Code帮你跑微调,选方法、验数据、估成本都包了。原文稍后读已读值得跟进有用关注 Fireworks
02:00The Rundown AI@therundownai精选Spotify将内部工具Xirp开放公开测试版。Xirp是工程师自建的工具,用于并行运行Claude Code、Gemini CLI和OpenAI Codex编码代理。该工具在Spotify内部已处理超过36,000次编码代理会话。用户可通过统一界面同时调度多个AI编程工具。AI产品XirpSpotifyClaude Code10 个信源在谈事件专题推荐理由:Spotify开放内部工具Xirp,一个界面同时跑Claude Code、Gemini CLI和OpenAI Codex,内部已处理3.6万次编码会话。原文稍后读已读值得跟进有用关注 Xirp
23:49向阳乔木@vista8精选OpenAI将顶级模型拆分为Doug和Astra两条产品线,前者负责实时多模态交互,后者专攻深度推理与工具调用。Meta开源了300亿参数的Muse Glimmer,为always-on Agent场景优化低功耗低延迟。Claude Code的Auto mode默认开启,由模型自主判断何时询问用户,并新增对恶意指令的防御。Google探索用扩散模型替代传统自回归文本生成,免费版Gemini Gems将于10月20日下线并迁移至Skills体系。AI模型OpenAIMetaClaude Code10 个信源在谈事件专题推荐理由:OpenAI把模型分成前台聊天和后台推理两条线,Meta开源了个300亿参数的边缘模型,Claude Code也自动干活了,快讯直接看这条。原文稍后读已读值得跟进有用关注 OpenAI
16:33AI Will@FinanceYF5精选Boris Cherny(@bcherny)在推文中称,通过叠加模型训练、输入探测和意图检查分类器等多层防御,可将间接提示注入在未见攻击上的成功率降至接近0。他表示一年前没预料到这一结果。Cherny同时宣布,Claude Code的Auto Mode将于下周起默认启用,细节见claude.com/blog/auto-mode。AI产品Claude CodeAuto Mode提示注入推荐理由:Boris Cherny说多叠几层防御,间接提示注入能降到接近零,下周Claude Code的Auto Mode也默认开了,搞安全的可以看看。原文稍后读已读值得跟进有用关注 Claude Code
16:30AI Will@FinanceYF5精选Boris Cherny透露,Claude Code通过模型训练、输入探测和意图分类器三层叠加,把间接提示词注入攻击成功率压到接近0%。这套防护对未见过的攻击变体依然有效。基于该防护,Auto Mode将从下周起成为默认模式。AI产品Claude CodeAuto Mode提示词注入推荐理由:Claude Code把间接提示词注入压到接近零,三层防护是核心,Auto Mode下周默认开启,搞Agent的可以关注。原文稍后读已读值得跟进有用关注 Claude Code
14:59量子位@梦晨Anthropic旗下编程工具Claude Code将在5天后默认开启自动模式。用户无需手动切换,即可让AI持续执行多步任务。若该模式产生超出预期的API调用费用,超出部分由Anthropic承担。官方用“会话越长,人的表现越差”来解释自动模式的价值。AI产品Claude CodeAnthropic编程助手10 个信源在谈事件专题推荐理由:Claude Code马上要默认开自动模式了,超支费用由Anthropic兜底,想省钱就得先搞懂这个变化。原文稍后读已读值得跟进有用关注 Claude Code
10:11shao__meng@shao__meng精选PawelHuryn 开源了 PM Skills Marketplace,把经典产品管理方法论封装成 68 个 Skills、42 个 Commands 和 9 个 Plugins,可接入 Codex、Cursor、Claude Code、WorkBuddy 等 AI 编程助手。项目采用三层架构,九个插件覆盖产品发现、战略、执行、市场研究、数据分析、GTM 等环节,例如 pm-product-discovery 包含 13 个 Skills 和 5 个 Commands。最特色的 pm-ai-shipping 插件有 2 个 Skills 和 5 个 Commands,能逆向生成系统文档、做静态安全/性能审计和测试覆盖映射,用来发现文档与代码实际行为不一致的问题。AI产品PM Skills MarketplaceCodexCursor5 个信源在谈事件专题推荐理由:PawelHuryn 开源了 PM Skills Marketplace,让 Codex 等工具按 PRD、OKR 这些流程干活,比裸用强。原文稍后读已读值得跟进有用关注 PM Skills Marketplace
03:25techcrunch@Anthony HaAnthropic宣布将Claude Code的自动模式设为默认。Claude Code的自动模式会减少编程时的人工监督。使用Claude Code的用户需适应更少的操作干预。Anthropic尚未公布该更新的版本号或基准成绩。AI产品Claude CodeAnthropic编程助手10 个信源在谈事件专题推荐理由:Anthropic把Claude Code自动模式设成默认了,以后不用你总盯着,它自己跑。原文稍后读已读值得跟进有用关注 Claude Code
02:59Jerry Liu@jerryjliu0精选LlamaIndex创始人Jerry Liu在X上发文,强调评估和hillclimbing在文档处理中的重要性。他认为未来FDE(领域专家)的工作将转向定义业务问题、编码评估标准,并利用自动化优化流程。他提到可以使用Claude Code或Codex来优化工作流,而FDE则专注于确保目标和评估的正确性。该推文还邀请有复杂文档处理需求的团队联系他们。技巧LlamaIndex文档处理评估推荐理由:LlamaIndex创始人聊文档处理的新思路,把评估和自动化优化结合起来,适合做复杂文档抽取的人看看。原文稍后读已读值得跟进有用关注 LlamaIndex
10:28Jerry Liu@jerryjliu0精选Jerry Liu在X上发文称,FDE的未来工作将围绕evals、posttraining和RL环境展开。他把FDE职责拆成三步:定义业务问题、将问题编码为评估标准与环境、在环境中逐步优化产出智能体工作流。目前第三步仍靠手工打造定制软件,未来可交给RL或Claude Code/Codex自动化优化。届时FDE的重心将从实现转向检查目标、环境和评估标准是否准确。行业FDEevalsposttraining推荐理由:Jerry Liu说未来FDE只需定目标和评估标准,具体实现交给RL或Claude Code自动搞定。原文稍后读已读值得跟进有用关注 FDE
06:40官方账号Simon Willison’s Weblog(博客/媒体)Anthropic 宣布自 8 月 14 日起,Claude Code 的 Auto 模式将成为 Pro、Max、Team 套餐新会话的默认设置。官方对比测试中,1,053 名付费测试者里有 13.6% 的人批准了被调包的危险命令,Auto 模式可拦截其中 89% 的动作。第三方机构 Trajectory Labs 对 Claude Fable 5、Opus 5、Sonnet 5 进行了 720 次间接提示注入攻击,全部被 Auto 模式拦截。Simon Willison 认为数据有力,但仍希望看到更多独立验证。AI产品Claude CodeAnthropicAI安全10 个信源在谈事件专题推荐理由:Claude Code 把 Auto 模式设为默认,官方测试拦下 89% 危险操作、720 次注入攻击,有第三方验证。原文稍后读已读值得跟进有用关注 Claude Code
23:04官方账号Decoder@Matthias Bastian8月14日起,Anthropic 将在 Claude Code 的 Pro、Max、Team 套餐中默认开启 Auto Mode。Anthropic 称自动模式更安全,测试中分类器能识别 89% 的危险命令,而人工审查仅有 13.6%。这意味着使用这一 AI 编程工具时,开发者角色更多从写代码转为监控 AI 输出。AI产品Claude CodeAnthropic编程助手10 个信源在谈事件专题推荐理由:Anthropic 把 Claude Code 自动模式设成默认,机器识别危险命令比人眼强得多,以后用 AI 写代码少担惊受怕。原文稍后读已读值得跟进有用关注 Claude Code
20:40官方账号Decoder@Matthias BastianClaude Code 在 macOS 和 Linux 上新增会话间通信功能。Claude Code 的并行会话实例可以互相发送消息、分享项目见解。Claude Code 的会话还能检查其他实例的状态,跨终端共享上下文。AI产品Claude CodemacOSLinux2 个信源在谈事件专题推荐理由:Claude Code 现在能让多个会话互相通信,跨终端分享上下文,适合开多窗口干活的人。原文稍后读已读值得跟进有用关注 Claude Code
18:13官方账号Decoder@Matthias Bastian气候科学家Zeke Hausfather用八周时间追踪了Claude Code的使用,消耗了32亿个token。这些操作约耗电170千瓦时,平均每个提示的能耗约为普通AI聊天提示的600倍。这一数据与Google和OpenAI公布的低能耗数字形成鲜明对比,反映出智能体AI的真实成本。Hausfather认为,官方报告中的数字扭曲了基于智能体的AI实际能耗状况。行业Claude CodeAnthropicAI智能体10 个信源在谈事件专题推荐理由:气候科学家实测Claude Code,8周烧了170度电,比普通聊天费600倍,官方报告可没告诉你这些。原文稍后读已读值得跟进有用关注 Claude Code
10:23小互@imxiaohuClaude Code 新功能“跨会话消息”让不同会话窗口间可以直接发送消息。用户可让一个窗口的 Claude 向另一个窗口的 Claude 分配任务,后者在任务进行中接手继续。该功能传的是纯文本摘要或回答,不涉及完整聊天记录或大文件,并支持跨 Git 工作树(Worktrees)协作。AI产品Claude CodeClaudeGit推荐理由:Claude Code 现在能在不同窗口间传话,你只管吩咐,AI 自己交接,跨 Git 分支干活更顺了。原文稍后读已读值得跟进有用关注 Claude Code
10:07IT之家(博客/媒体)Anthropic 于 8 月 8 日宣布,Claude Code v2.1.224 起支持跨会话消息传递。不同会话之间可以互相发送更新和相关消息,方便用户在多个会话中协同项目。当一个会话的更改破坏另一个会话的内容时,Claude 会在用户注意到前发出警告。官方推荐用于移交调查结果、协调并行工作树、获取长时间运行任务状态及跨机器回复。AI产品Claude CodeAnthropic跨会话消息7 个信源在谈事件专题推荐理由:写代码时开好几个 Claude Code 会话的可以试试,现在会话之间能互相喊话了,改坏了会提前提醒你。原文稍后读已读值得跟进有用关注 Claude Code
09:22IT之家(博客/媒体)精选Anthropic宣布8月14日起,Pro、Max和Team用户的Claude Code默认权限改为自动模式。该模式用独立分类器实时评估工具调用和Shell命令,拦截破坏性操作。在1053名付费测试者中,自动模式识别出89%的危险命令,而人工审批仅识别13.6%。提示词注入评估中,720次攻击下Claude Fable 5、Opus 5和Sonnet 5全部拦截,GPT-5.6 Sol在Codex自动审阅下成功率为5.83%。AI产品Claude CodeAnthropic自动模式10 个信源在谈事件专题推荐理由:Anthropic把Claude Code默认权限改成自动模式,危险命令识别率从13.6%提到89%,还防提示词注入。原文稍后读已读值得跟进有用关注 Claude Code
09:02Latent.Space@latentspacepod精选Claude Code 将于下周把 Auto Mode 设为默认模式。该模式通过组合模型训练、输入探测和意图检查分类器,将间接提示注入在未见攻击样本上的成功率降至接近 0。开发者 Boris Cherny 表示,一年前他没想到能达到这个效果。AI产品Claude CodeAuto Mode提示注入推荐理由:Claude Code 的 Auto Mode 下星期默认开,提示注入基本攻不进来,自动跑任务更安全了。原文稍后读已读值得跟进有用关注 Claude Code
06:03官方一手marktechpost@Michal Sutter腾讯云开源了TencentDB Agent Memory v2.0,一个面向AI编码代理的团队级记忆中枢。它通过Chat Memory、Skill、LLM-Wiki和Code-Graph四类资产,将对话、文档和代码转化为可复用资源。该项目采用MIT许可证,可通过Docker自托管,并已集成Claude Code、OpenClaw、Hermes和CodeBuddy。其核心差异是治理能力:基于ACL的可见性控制决定每个代理可访问的资产与版本。AI产品TencentDB Agent MemoryTencent CloudClaude Code推荐理由:腾讯云把Agent Memory v2.0开源了,主打ACL权限治理,团队里不同编码代理能共享记忆。原文稍后读已读值得跟进有用关注 TencentDB Agent Memory
04:02官方账号Simon Willison@simonwSimon Willison把四年前用GPT-3和DALL-E生成的游戏概念图当作规格,让Fable 5构建出可玩网页游戏《Raccoon Heist》。同一提示词下,Fable 5和Claude Code各生成了一款游戏用于对比。游戏已托管在simonw.github.io,可直接在浏览器试玩。AI产品FableClaude CodeGPT-3推荐理由:Simon用四年前的AI概念图让Fable生成可玩游戏《Raccoon Heist》,还能和Claude Code的版本对比,点开就能玩。原文稍后读已读值得跟进有用关注 Fable
19:48AI产品黄叔@PMbackttfuture一位用户分享称,现在用 WorkBuddy 中的 v4 flash 模型就能完成 Skill 的创建、优化与运行,不再需要 Claude Code。去年10月底 Skill 功能推出时,官方还要求必须使用 Claude Code,因为当时只有 Claude 模型能较好完成这项任务。不到一年时间,v4 flash 已经能独立承担全流程。相比之下,v4 flash 的接入大幅降低了 WorkBuddy 的使用门槛。技巧WorkBuddyv4 flashClaude Code推荐理由:用户实测:WorkBuddy 里的 v4 flash 就能搞定 Skill 的创建、优化和运行,去年还得靠 Claude Code。原文稍后读已读值得跟进有用关注 WorkBuddy
15:10IT之家(博客/媒体)Composio 在 X 平台公布测试结果,用 30 项真实任务对比 Oh My Pi、Claude Code、Codex、OpenCode 4 个 AI 编程智能体框架,统一调用 DeepSeek V4 Flash 正式版。Oh My Pi 以 17/30 的成功率排名第一,但每任务耗时 272 秒最慢。Claude Code 速度最快(122 秒/任务),成本却最高,每成功任务 0.195 美元。OpenCode 成本最低,每成功任务仅 0.073 美元。测试覆盖 Gmail、GitHub、Slack 等真实工具场景。AI模型DeepSeek V4 FlashComposioOh My Pi10 个信源在谈事件专题推荐理由:想给 DeepSeek V4 Flash 配个编程智能体?Composio 实测了 4 个,Oh My Pi 成功率最高,OpenCode 最省钱,按需求挑。原文稍后读已读值得跟进有用关注 DeepSeek V4 Flash
14:05官方一手Claude Code: GitHub Releases@ashwin-antClaude Code v2.1.224 新增自托管环境支持,可将自有机器或容器作为运行后端,适用于 Team 和 Enterprise 计划。同时支持从 HTTPS ZIP 安装插件,并可用 SHA-256 固定校验。新增跨会话消息功能,Claude Code 会话可在多台机器间互相通信。修复了沙箱拒绝规则被绕过、长路径混淆等多个安全问题。AI产品Claude CodeAnthropic编程助手10 个信源在谈事件专题推荐理由:Claude Code 更新了,能用自己的机器跑会话,还能跨设备发消息,安全修复也不少。原文稍后读已读值得跟进有用关注 Claude Code