7月24日
08:19
08:19岚叔@lufzzliz
用户在微博提到GPT Voice功能尚未完全开放,但发现一个更实用的更新:创建项目时支持添加多个文件夹。这个功能省去了向Codex额外指定目录的步骤。对于多模块项目,该改动能提升编程效率,减少重复操作。
推荐理由:哥们,Codex更新了:建项目能加多个文件夹了,再也不用每次都手动说‘参考xx目录’,省事不少!
05:45
05:45官方一手@OpenAIDevs@OpenAIDevs
精选
OpenAI 的 AI 编程工具 Codex 现已支持在一个项目中包含多个文件夹。用户可以将相关代码、文档和引用文件放置在不同目录中,Codex 能够跨这些目录进行读取和写入。主文件夹仍作为 Git 根目录保持不变。该功能在 X 平台获得超过 900 点赞和 3 万次浏览。
事件专题

推荐理由:想在一个 Codex 项目里管理多个文件夹的代码和文档?现在可以了,Codex 能跨目录读写,主文件夹还是 Git 根。
05:38
05:38官方账号Together AI@togethercompute
Kimi K3 模型将于7月27日通过 Together AI 平台上线,用户可在发布当天立即使用其推理服务。该服务支持编程、智能体以及生产负载等场景。Together AI 提供高性能推理基础设施,使开发者能第一时间体验 Kimi K3。
事件专题

推荐理由:Kimi K3 马上就能在 Together AI 上用了,7月27日当天就能跑编程和智能体任务,想抢先体验的快去试试。
04:39
04:39Harrison Chase@hwchase17
OpenWiki 0.2.3 版本支持序列图、架构图等图表,用于组织代码库知识。图表比文字描述减少 token 数量,为智能体提供更具体的数据流和复杂关系结构。该更新帮助开发者更高效地记录和梳理代码库中的逻辑。
推荐理由:OpenWiki 出新版了,能画架构图和序列图,智能体看图表比读文字省 token 还更清楚代码关系。
7月23日
22:37
22:37官方账号LMSYS Org (SGLang)@lmsysorg
81°
Poolside发布Laguna S 2.1模型,总参数量118B,采用稀疏MoE架构,每token仅激活8B参数。模型支持1M上下文窗口,提供思考与非思考两种模式。在Terminal-Bench 2.1上获得70.2%准确率,在SWE-bench Multilingual上达78.5%。官方NVFP4量化版本可运行于单个NVIDIA DGX Spark。模型已在SGLang框架上提供Day-0支持。
事件专题

推荐理由:Poolside的Laguna S 2.1是个118B参数的稀疏MoE模型,只激活8B参数,SWE-bench多语言拿下78.5%,还能跑在单个DGX Spark上,适合长时编程任务。
11:51
11:51Geek@geekbb
精选
该工具通过 ps 和 lsof 扫描终端进程,在 MacBook 刘海右侧展示 Claude Code 和 Codex 等代理的实时状态。每个代理有独立槽位:运行中吉祥物在刘海旁走动,完成后变绿点。点击吉祥物可展开面板,按会话分组显示每轮对话的提示词和子代理。

推荐理由:用这个小工具,MacBook 刘海就能实时显示 Claude Code、Codex 等代理的运行状态,还有吉祥物走动,点开还能看每轮对话的提示词,挺有意思的。
05:39
02:39
02:39elvis@omarsar0
Bolt.new发布了新的Skills功能,实现了技能自动匹配,开发者无需每次手动调用特定技能。代理能自动判断何时使用哪些技能,并且团队构建的技能对所有成员共享。一个提示即可自动触发所有匹配的技能,简化了多代理协作编程的流程。
推荐理由:Bolt.new这个新功能太实用了,自动匹配技能,不用每次都喊'用代码生成技能',团队技能还能共享,一个提示搞定所有。
00:04
00:04官方一手AWS Machine Learning Blog@Claudio Mazzoni
82°
monday.com 在 Amazon Bedrock 上部署生产级 AI 智能体 AI Teammates。内部数据显示 90% 的开发者每月使用 AI 编码工具,较半年前的 50% 增长明显。每位工程师的 PR 吞吐量提升超过 50%。文章介绍了针对十年旧代码库的架构改造和自信度评分合并机制,向完全自主迈进一步。
事件专题

推荐理由:monday.com 分享了在 Amazon Bedrock 上跑 AI 智能体的真实数据和架构,开发者可以抄作业提升编码效率。
7月22日
17:06
17:06Thomas Wolf@Thom_Wolf
Poolside AI 发布最新 agentic coding 模型 Laguna S 2.1。在 Terminal-Bench 2.1 上得分 70.2,与 5-25 倍大小的模型并列甚至领先。在 DeepSWE 基准上得分 40.4,超越部分超 1T 参数的开源模型。该模型可在单个 DGX Spark 或 Mac 上本地运行。
事件专题

推荐理由:Poolside 又出了个厉害编码模型,Laguna S 2.1 在本地就能跑,多项基准比大它几十倍的模型还强。
16:46
15:45
15:32
15:32@koltregaskes@koltregaskes
一位用户在X平台表示,经过一段时间使用后,认为GPT-5.6是自GPT-4相比GPT-3.5以来最明显的性能跳跃。该模型更善于按照指令完成任务,执行力显著增强。用户同时指出主要问题在于Codex(编程界面)仍需大量改进。
事件专题

推荐理由:有用户说GPT-5.6干活更利索比之前版本强一大截,但Codex还不够好,来看看他的体验。
14:04
14:04官方一手歸藏(guizang.ai)@op7418
78°
谷歌上线Gemini 3.6 Flash模型,相比3.5 Flash在编码、推理和工具调用上有所提升,在DeepSWE基准上输出token减少高达65%。同时推出速度更快的3.5 Flash-Light模型。谷歌宣布已开始训练Gemini 4,称规模为史上最大,目标对标GPT-5.6和Fable 5。目前模型迭代速度落后于一月一版的竞品。
事件专题

推荐理由:谷歌出了Gemini 3.6 Flash,日常模型更强了,编码和推理升级,还省了最多65%的token。另外还有个更快的3.5 Flash-Light,Gemini 4也在训练了,可以关注。
02:49
02:49OpenRouter@OpenRouterAI
PoolsideAI 发布了开放权重的 Laguna S 2.1 模型,采用 118B-A8B 混合专家架构。该模型拥有 1M 上下文窗口,专门用于智能体编码和长时任务。在 Terminal-Bench 2.1 基准上得分 70.2%,在 DeepSWE 上得分 40.4%。模型现已通过 OpenRouter 平台提供使用。
推荐理由:PoolsideAI 出的 Laguna S 2.1,118B MoE 带 1M 上下文,Terminal-Bench 上 70.2%,专搞编码智能体,想试试直接去 OpenRouter 用。
02:14
02:14Cognition@cognition_labs
精选72°
Cognition宣布Devin Outposts可在NVIDIA Brev上部署。这一集成使Devin能够访问GPU基础设施,用于调试训练运行、检查GPU状态、重现故障,并在实际硬件上验证修复。部署入口位于brev.nvidia.com的launchable页面。该方案面向需要GPU调试的AI工程团队。
事件专题

推荐理由:Cognition把Devin Outposts搬上NVIDIA Brev,让Devin能直接动用GPU来定位训练bug、检查显存状态,不用自己搭环境。