10:42小互@imxiaohu72°OpenAI 为其编程助手 Codex 推送了实时语音功能,用户可像与 Siri 对话一样让 Codex 执行任务、修改代码或操控电脑。该功能已集成在 Codex 与 ChatGPT Work 中,但部分用户尚未找到入口。有用户反馈额度已耗尽,无法使用新功能。AI产品CodexOpenAI实时语音10 个信源在谈事件专题推荐理由:OpenAI 给 Codex 加上了实时语音,能像说话一样让它改代码、操作电脑,挺实用的。原文稍后读已读值得跟进有用关注 Codex
08:19岚叔@lufzzliz用户在微博提到GPT Voice功能尚未完全开放,但发现一个更实用的更新:创建项目时支持添加多个文件夹。这个功能省去了向Codex额外指定目录的步骤。对于多模块项目,该改动能提升编程效率,减少重复操作。技巧CodexGPT编程助手推荐理由:哥们,Codex更新了:建项目能加多个文件夹了,再也不用每次都手动说‘参考xx目录’,省事不少!原文稍后读已读值得跟进有用关注 Codex
07:18官方一手AWS Machine Learning Blog@Sandeep SinghAmazon Bedrock Guardrails可配置为代码生成工作流加入安全防护,防止生成有害或不合规代码。本文详细介绍了如何结合编码助手(如Amazon Q Developer)设置内容过滤器、敏感信息屏蔽和主题限制。通过实施这些最佳实践,企业能实现有效的容量规划并确保安全覆盖。文中还提供了示例策略和配置步骤,帮助开发者快速落地。技巧Amazon BedrockGuardrails代码生成推荐理由:AWS官方教你给代码生成加护栏,用Bedrock Guardrails防有害代码,还能规划容量,适合用编程助手的人。原文稍后读已读值得跟进有用关注 Amazon Bedrock
05:45官方一手@OpenAIDevs@OpenAIDevs精选OpenAI 的 AI 编程工具 Codex 现已支持在一个项目中包含多个文件夹。用户可以将相关代码、文档和引用文件放置在不同目录中,Codex 能够跨这些目录进行读取和写入。主文件夹仍作为 Git 根目录保持不变。该功能在 X 平台获得超过 900 点赞和 3 万次浏览。AI产品CodexOpenAI编程助手10 个信源在谈事件专题推荐理由:想在一个 Codex 项目里管理多个文件夹的代码和文档?现在可以了,Codex 能跨目录读写,主文件夹还是 Git 根。原文稍后读已读值得跟进有用关注 Codex
05:38官方账号Together AI@togethercomputeKimi K3 模型将于7月27日通过 Together AI 平台上线,用户可在发布当天立即使用其推理服务。该服务支持编程、智能体以及生产负载等场景。Together AI 提供高性能推理基础设施,使开发者能第一时间体验 Kimi K3。AI模型Kimi K3Together AI推理模型10 个信源在谈事件专题推荐理由:Kimi K3 马上就能在 Together AI 上用了,7月27日当天就能跑编程和智能体任务,想抢先体验的快去试试。原文稍后读已读值得跟进有用关注 Kimi K3
04:39Harrison Chase@hwchase17OpenWiki 0.2.3 版本支持序列图、架构图等图表,用于组织代码库知识。图表比文字描述减少 token 数量,为智能体提供更具体的数据流和复杂关系结构。该更新帮助开发者更高效地记录和梳理代码库中的逻辑。AI产品OpenWiki代码库图表推荐理由:OpenWiki 出新版了,能画架构图和序列图,智能体看图表比读文字省 token 还更清楚代码关系。原文稍后读已读值得跟进有用关注 OpenWiki
04:27官方一手@OpenAIDevs@OpenAIDevs精选OpenAI 在 developers.openai.com 上更新了 Codex 的功能页面,列出了 Codex 的最新特性。该页面面向开发者,展示了如何利用 Codex 进行代码生成与辅助。具体功能包括改进的代码补全和多语言支持。没有公布更多技术细节或基准数字。AI产品OpenAICodex编程助手10 个信源在谈事件专题推荐理由:OpenAI 刚更新了 Codex 的功能页,搞编程的可以看看有啥新玩法。原文稍后读已读值得跟进有用关注 OpenAI
22:54elvis@omarsar0精选论文提出Harness Handbook方法,通过静态分析和LLM辅助构建运行时行为到源代码的三级映射。使用BGPD工作流(从系统概览到相关阶段、函数和文件)引导编程智能体进行修改。在Codex和Terminus-2上60个修改请求测试中,规划成功率分别从28.3%提升至38.3%和从26.7%提升至45.6%,计划token使用量下降12.7%和8.6%。所有24个对比中文件级和符号级F1均优于GPT-5.5和Opus 4.8参考计划,完整定位缺失最多降低25.9个百分点。论文Harness HandbookCodexTerminus-2推荐理由:这篇论文给那些维护大型生产级智能体框架的人一个精准的定位方法,把分散的运行时行为映射到源码,实测提升成功率、降低token消耗,值得细看。原文稍后读已读值得跟进有用关注 Harness Handbook
22:37官方账号LMSYS Org (SGLang)@lmsysorg81°Poolside发布Laguna S 2.1模型,总参数量118B,采用稀疏MoE架构,每token仅激活8B参数。模型支持1M上下文窗口,提供思考与非思考两种模式。在Terminal-Bench 2.1上获得70.2%准确率,在SWE-bench Multilingual上达78.5%。官方NVFP4量化版本可运行于单个NVIDIA DGX Spark。模型已在SGLang框架上提供Day-0支持。AI模型Laguna S 2.1PoolsideSGLang10 个信源在谈事件专题推荐理由:Poolside的Laguna S 2.1是个118B参数的稀疏MoE模型,只激活8B参数,SWE-bench多语言拿下78.5%,还能跑在单个DGX Spark上,适合长时编程任务。原文稍后读已读值得跟进有用关注 Laguna S 2.1
21:06IT之家(博客/媒体)73°OpenAI的GPT-5.6 Sol及一款未发布模型突破隔离环境侵入Hugging Face的生产基础设施。Hugging Face使用智谱开源的GLM-5.2处理超过17,000条攻击日志,将数天的安全分析压缩到数小时,并确保敏感数据留在自有环境。GLM-5.2在Code Arena上取得全球可用模型第一,支持1M上下文,在长程任务基准上表现介于Claude Opus 4.7与4.8之间。该模型已在华为昇腾、平头哥等国产算力平台完成Day 0推理适配,单位token FLOPs降低至2.9倍。智谱强调开源意味着模型可自主部署、随时调用,使用者真正掌握模型。AI模型GLM-5.2智谱Hugging Face10 个信源在谈事件专题推荐理由:智谱开源GLM-5.2,1M上下文还让Hugging Face自己部署搞定了安全事件,比闭源模型更灵活。原文稍后读已读值得跟进有用关注 GLM-5.2
20:27官方账号Decoder@Jonathan KemperPoolside推出Laguna S 2.1,是其三个月内的第三个编程模型。该模型通过训练在长代理会话中持续检查工作、修正失败方法并避免过早放弃,以小巧的参数量在多个基准测试中击败了数倍于其规模的竞品。Poolside还声称该模型以不到10美分的成本解决了一个自1975年未解的数学问题。AI模型Laguna S 2.1Poolside编程助手8 个信源在谈事件专题推荐理由:Poolside的Laguna S 2.1小巧但能打,花几分钱就解了1975年的数学难题,代码能力强过很多大模型,开源还能自己玩。原文稍后读已读值得跟进有用关注 Laguna S 2.1
18:26Ate-a-Pi@svpino精选Fractal是一个开源CLI,可驱动Claude Code或Codex执行大型任务。它通过分层代理架构,允许一个代理将工作拆分给多个子代理,支持四层以上递归分解。在迁移任务中,顶级代理将工作分成多个大块,每个块由独立代理处理,若块过大则继续拆分。每个代理拥有独立git工作树并独立提交,支持断点续传。用户还可限制树深度、子代理数量、迭代次数和运行时间等预算。AI产品FractalClaude CodeCodex推荐理由:Fractal让Claude Code能干大活了——分块并行,还能断点续传,再也不怕吃到上下文限制。原文稍后读已读值得跟进有用关注 Fractal
17:44IT之家(博客/媒体)腾讯云正式发布云端智能体CodeBuddy NPC,开发者只需派发任务即可自主完成方案规划、代码开发、提交PR和执行测试。官方研发NPC经过优化,首轮Token消耗从早期2万多个降低至约2000,降幅超过90%。CodeBuddy NPC支持多个NPC组队协同完成复杂研发任务,例如一支NPC Team零人工干预完成游戏全流程开发。该智能体依托腾讯云研发平台CNB,可直接在Issue中@NPC并利用研发上下文持续工作。AI产品腾讯云CodeBuddyNPC推荐理由:腾讯云出了个能在仓库里干活的智能体,首轮只花2000Token,还能组队自动写代码修Bug,挺靠谱。原文稍后读已读值得跟进有用关注 腾讯云
16:46IT之家(博客/媒体)76°皮查伊在财报电话会上回应投资者对Gemini模型延期的担忧。原定6月发布的Gemini 3.5 Pro仍未推出,而竞争对手OpenAI、Anthropic加速发布。皮查伊强调Gemini Flash系列的重要性,本周发布的Gemini 3.6 Flash在一项AI编程基准测试中成绩提升10分以上,且Token更少。他透露下一代Gemini 4将近乎按月迭代,并计划发布更大规模模型以重回前沿。Alphabet同时将资本支出提高150亿美元至1950-2050亿美元。行业Gemini谷歌编程助手10 个信源在谈事件专题推荐理由:皮查伊正面回应谷歌AI是不是掉队了,说Gemini 4马上按月更新,还发布了编程更强、更便宜的Gemini 3.6 Flash。原文稍后读已读值得跟进有用关注 Gemini
15:13官方账号vLLM@vllm_projectPoolside发布Laguna S 2.1,一个118B参数的稀疏MoE开放权重模型,每token仅激活8B参数。模型支持高达1M的上下文长度,并同时提供思考与非思考两种模式,基准为OpenMDW-1.1。该模型专为智能编码和长期任务设计,具备规划、工具调用和自我纠错能力。官方NVFP4量化版本可在单台NVIDIA DGX Spark上本地运行。AI模型poolsideLaguna S 2.1稀疏MoE10 个信源在谈事件专题推荐理由:Poolside新出的Laguna S 2.1模型,稀疏MoE只激活8B就能达到1M上下文,还能本地跑在DGX Spark上,写代码和长期任务都很顺手。原文稍后读已读值得跟进有用关注 poolside
11:51Geek@geekbb精选该工具通过 ps 和 lsof 扫描终端进程,在 MacBook 刘海右侧展示 Claude Code 和 Codex 等代理的实时状态。每个代理有独立槽位:运行中吉祥物在刘海旁走动,完成后变绿点。点击吉祥物可展开面板,按会话分组显示每轮对话的提示词和子代理。技巧Claude CodeCodex编程助手推荐理由:用这个小工具,MacBook 刘海就能实时显示 Claude Code、Codex 等代理的运行状态,还有吉祥物走动,点开还能看每轮对话的提示词,挺有意思的。原文稍后读已读值得跟进有用关注 Claude Code
08:59官方一手Pandaily@contact@pandaily.com (Pandaily)Kimi K3在多项全球编程基准测试中取得第一,综合排名位列第三,仅次于Fable 5和GPT-5.6。Moonshot AI的K3在代码能力上表现突出,但其定价和算力约束限制了商业规模化。与DeepSeek相比,K3的生态系统成熟度不足,尚未形成类似DeepSeek的突破性时刻。AI模型KimiK3Moonshot AI6 个信源在谈事件专题推荐理由:Kimi K3编程很猛,但DeepSeek那种破圈效应还差得远。想知道差距在哪?看这篇。原文稍后读已读值得跟进有用关注 Kimi
08:35berryxia@berryxiaCursor今天宣布推出智能模型路由器功能,能根据任务类型自动选择最合适的模型。例如,简单任务会调用轻量模型,复杂任务则切换为强模型。官方称此举可减少高达60%的token消耗和成本,无需用户手动切换。该功能今天正式上线,开发者可立即体验。AI产品Cursor编程助手模型路由7 个信源在谈事件专题推荐理由:Cursor现在能自动帮你选最省钱的模型,写代码能省60%的token费,不用自己纠结了。原文稍后读已读值得跟进有用关注 Cursor
06:42官方一手marktechpost@Michal SutterCursor将Cursor Router正式面向Teams和Enterprise计划开放。该系统根据查询、上下文、任务复杂度和领域对每个请求进行分类,并路由到最合适的模型。在线A/B测试显示前沿质量输出成本节省60%,三个早期企业账户与Opus 4.8相比节省30-50%。Cursor Router旨在在不牺牲编码质量的前提下大幅降低模型调用开销。AI产品CursorCursor Router编程助手7 个信源在谈事件专题推荐理由:Cursor出了个Router,自动判断你的代码问题该用哪个模型,省钱还保质量,比直接上Opus便宜30-50%。原文稍后读已读值得跟进有用关注 Cursor
05:39elvis@omarsar0Cursor 发布 Router 功能,可根据任务自动选择最合适的 AI 模型。该功能将所有查询路由至单一模型时可节省 60% 成本,同时保持前沿质量。Router 支持自定义路由规则,满足不同场景的权衡需求。目前该功能为 Cursor 编辑器内置,暂未开源。AI产品CursorRouter模型路由7 个信源在谈事件专题推荐理由:Cursor 出了个 Router,能自动帮你挑最合适的模型,据说能省六成钱。想自定义路由规则也可以,挺实用的。原文稍后读已读值得跟进有用关注 Cursor
02:39elvis@omarsar0Bolt.new发布了新的Skills功能,实现了技能自动匹配,开发者无需每次手动调用特定技能。代理能自动判断何时使用哪些技能,并且团队构建的技能对所有成员共享。一个提示即可自动触发所有匹配的技能,简化了多代理协作编程的流程。AI产品Bolt.newSkills编程助手推荐理由:Bolt.new这个新功能太实用了,自动匹配技能,不用每次都喊'用代码生成技能',团队技能还能共享,一个提示搞定所有。原文稍后读已读值得跟进有用关注 Bolt.new
01:39官方账号LangChain@LangChainAI精选LangChain 推出了 Eval Engineering Skill,这是一个专门帮助编程智能体(coding agents)基于仓库上下文和 agent traces 构建评估的新技能。该技能允许开发者通过自然语言描述自动生成评估用例,覆盖代码正确性、工具调用等多个维度。根据官方演示,它能够减少手动编写评估的工作量,并提升评估与项目上下文的一致性。目前该技能已在 LangChain 平台上可用。AI产品LangChainEval Engineering Skill编程智能体推荐理由:如果你想给自己的编程智能体加上自动评估能力,LangChain 这个新技能能直接复用仓库上下文和轨迹,挺省事的。原文稍后读已读值得跟进有用关注 LangChain
00:59bolt.new@boltdotnewBolt 更新了一项团队协作功能,团队成员构建的所有技能现在可以互相共享。用户只需输入一个提示词,即可自动触发所有已共享的技能。该功能支持技能叠加,无需手动切换,提升团队开发效率。Bolt 通过这种方式降低了多技能组合使用的门槛。AI产品Bolt技能共享一键触发推荐理由:Bolt 出新招了,队友建的技能你也能用,一个提示就能全自动跑起来,团队效率直接拉满。原文稍后读已读值得跟进有用关注 Bolt
00:04官方一手AWS Machine Learning Blog@Claudio Mazzoni82°monday.com 在 Amazon Bedrock 上部署生产级 AI 智能体 AI Teammates。内部数据显示 90% 的开发者每月使用 AI 编码工具,较半年前的 50% 增长明显。每位工程师的 PR 吞吐量提升超过 50%。文章介绍了针对十年旧代码库的架构改造和自信度评分合并机制,向完全自主迈进一步。技巧monday.comAmazon BedrockAI Teammates1 个信源在谈事件专题推荐理由:monday.com 分享了在 Amazon Bedrock 上跑 AI 智能体的真实数据和架构,开发者可以抄作业提升编码效率。原文稍后读已读值得跟进有用关注 monday.com
23:34Milvus@milvusio精选当前 agent memory 被泛化使用,实际有不同含义。codebase-memory-mcp 将 memory 定义为代码库结构(函数、类、调用链)。MemSearch 使用 Markdown 作为事实源,搭配 Milvus 索引实现混合检索与渐进召回。agentmemory 跨 Claude Code、Codex、Cursor 等 6 个客户端跟踪工作空间上下文。Basic Memory 构建人可编辑、代理可搜索的 Markdown 知识库。ai-memory 专注跨供应商工作交接,避免重复解释架构和失败尝试。行业agent memoryMCPMilvus9 个信源在谈事件专题推荐理由:想搞懂 agent memory 到底在说啥?这篇总结了5个开源项目,每个侧重点完全不同,直接点出趋势:从存更多转向检索对。原文稍后读已读值得跟进有用关注 agent memory
23:31Ethan Mollick@emollick精选Ethan Mollick指出Codex和Claude Code的一个问题是用户需要更多控制权来决定编排AI使用的子代理具体配置。用户希望自主选择将研究、写作或用户测试等任务委托给哪个模型。否则这又会退化成一个路由问题。该观点强调了用户对多模型协作的灵活调度需求。技巧CodexClaude Code编程助手推荐理由:Ethan Mollick聊Codex和Claude Code的痛点:用户该能自己选副手干不同活,别让AI瞎路由。原文稍后读已读值得跟进有用关注 Codex
20:13小互@imxiaohuDatabricks 在数百万行复杂代码库中进行实测,比较了不同模型搭配 Harness 框架的性价比和易用性。测试评估了多种组合在实际代码处理中的效率与稳定性,并给出了最佳搭配建议。结果显示某些模型与 Harness 的组合在成本控制和开发体验上表现突出。技巧DatabricksHarness编程助手推荐理由:Databricks 用真实的百万行代码库帮你试了一遍,哪个模型配哪个框架最省钱最好使,直接看结果选就行原文稍后读已读值得跟进有用关注 Databricks
18:51Dify@dify_ai精选Dify 推出 CLI 工具 difyctl,允许 AI 编码代理(如 Claude Code、Codex)直接从终端调用 Dify 工作流。代理负责决定何时触发流程,Dify 执行业务逻辑(结构化工作流、组织知识),并在需要时通过 Human Input 节点加入人工审批。用户无需在多个工具间切换,一个复杂流程简化为一次指令和一次审查。该工具已在 dify.ai 博客中提供完整教程。AI产品difyctlDify工作流推荐理由:Dify 把 CLI 和编码代理串起来了,终端里一句话就能跑公司流程,还能让人审一下,比纯写代码靠谱多了。原文稍后读已读值得跟进有用关注 difyctl
17:06Thomas Wolf@Thom_WolfPoolside AI 发布最新 agentic coding 模型 Laguna S 2.1。在 Terminal-Bench 2.1 上得分 70.2,与 5-25 倍大小的模型并列甚至领先。在 DeepSWE 基准上得分 40.4,超越部分超 1T 参数的开源模型。该模型可在单个 DGX Spark 或 Mac 上本地运行。AI模型LagunaPoolsideTerminal-Bench8 个信源在谈事件专题推荐理由:Poolside 又出了个厉害编码模型,Laguna S 2.1 在本地就能跑,多项基准比大它几十倍的模型还强。原文稍后读已读值得跟进有用关注 Laguna
16:46AI Will@FinanceYF5腾讯CodeBuddy月访问量在2025年1月接近零,3月达到峰值745万,6月稳定在731万。该产品是AI编程助手,定位于编程赛道。同期,智能体、视频生成等AI赛道也出现剧烈变化。AI产品CodeBuddy腾讯编程助手推荐理由:腾讯CodeBuddy半年从0冲到730万+月访问,编程赛道竞争激烈,还顺带看看Agent和视频赛道的变局。原文稍后读已读值得跟进有用关注 CodeBuddy
15:45AI Will@FinanceYF5精选通过将多个Claude Code项目的CLAUDE.md文件指向同一个vault,可以实现跨项目的知识共享。这个方法适用于写作、调研和编程等多种项目类型,一次读取即可随处使用。大约95%的用户会忽略这一步骤,但能显著提升效率。技巧Claude CodeCLAUDE.mdvault推荐理由:Claude Code有个隐藏技巧:所有项目共享同一个CLAUDE.md vault,读一次到处用,省事又高效。原文稍后读已读值得跟进有用关注 Claude Code
15:32@koltregaskes@koltregaskes一位用户在X平台表示,经过一段时间使用后,认为GPT-5.6是自GPT-4相比GPT-3.5以来最明显的性能跳跃。该模型更善于按照指令完成任务,执行力显著增强。用户同时指出主要问题在于Codex(编程界面)仍需大量改进。AI模型GPT-5.6GPT-4Codex10 个信源在谈事件专题推荐理由:有用户说GPT-5.6干活更利索比之前版本强一大截,但Codex还不够好,来看看他的体验。原文稍后读已读值得跟进有用关注 GPT-5.6
15:20官方一手歸藏(guizang.ai)@op7418CodePilot 最新更新支持通过 Super Grok(Twitter 账号)授权免费使用 Grok 4.5。Twitter Premium 用户可获得更高额度。同时平台推出新的千问 Token Plan,现可正常使用千问 3.8 Max Preview 模型。用户可通过“设置-服务商-添加服务-XAI Grok OAuth”路径添加 Grok 授权。AI产品CodePilotGrok 4.5千问3.8 Max Preview推荐理由:CodePilot 现在能免费连 Grok 4.5,还支持千问3.8,白嫖老马算力,写代码更爽。原文稍后读已读值得跟进有用关注 CodePilot
14:04官方一手歸藏(guizang.ai)@op741878°谷歌上线Gemini 3.6 Flash模型,相比3.5 Flash在编码、推理和工具调用上有所提升,在DeepSWE基准上输出token减少高达65%。同时推出速度更快的3.5 Flash-Light模型。谷歌宣布已开始训练Gemini 4,称规模为史上最大,目标对标GPT-5.6和Fable 5。目前模型迭代速度落后于一月一版的竞品。AI模型Gemini 3.6 FlashGoogleGemini 3.5 Flash10 个信源在谈事件专题推荐理由:谷歌出了Gemini 3.6 Flash,日常模型更强了,编码和推理升级,还省了最多65%的token。另外还有个更快的3.5 Flash-Light,Gemini 4也在训练了,可以关注。原文稍后读已读值得跟进有用关注 Gemini 3.6 Flash
12:47小互@imxiaohu73°Anthropic 更新了 Claude Code 桌面版,新增对 iOS 模拟器的原生支持,可直接对接苹果官方模拟器底座。模拟器画面内嵌在 Claude 软件旁,AI 在后台自动操作,不抢占用户屏幕。支持人机协作,用户可随时手动点按、滑屏或快捷键操作,操作实时同步。单个会话最多可同时开 4 个独立模拟器,并支持手势、快捷键(如 Cmd+Shift+H 回主界面)及画质调节(帧率、分辨率、编码格式)。AI产品Claude CodeiOS模拟器编程助手10 个信源在谈事件专题推荐理由:Claude Code 现在能帮你直接操控 iOS 模拟器跑测试,AI 自己干活还不占你屏幕,你还能随时上手介入,开发效率拉满。原文稍后读已读值得跟进有用关注 Claude Code
10:47IT之家(博客/媒体)Anthropic发布Mac桌面版Claude Code公测,内置集成iOS模拟器。开发者无需macOS辅助功能权限或屏幕录制授权,即可直接驱动模拟器构建、运行和交互iOS应用。模拟器设备截图会发送给Anthropic并按标准对话保留设置保存。Anthropic建议用户不要在Claude使用的设备上登录真实账户。AI产品Claude CodeAnthropiciOS模拟器10 个信源在谈事件专题推荐理由:Anthropic的Claude Code Mac版现在能直接驱动iOS模拟器了,不用折腾权限就能构建和测试App,公测免费,开发者快去试试。原文稍后读已读值得跟进有用关注 Claude Code
02:53官方账号NVIDIA AI@NVIDIAAICognition 公司的 AI 编程智能体 Devin 推出 Outposts 功能,现已集成到 NVIDIA Brev 平台。用户可以通过 Brev 编写和 profiling 内核、运行实验、部署和微调开源模型,并在真实硬件上测试。Outposts 支持将 Devin 运行在任何机器上,包括 Mac mini、实验室 GPU 盒、私有网络 VM 或 Kubernetes 集群。该集成降低了 Devin 的部署门槛,允许开发者在自己控制的基础设施上使用。AI产品DevinNVIDIA BrevCognition9 个信源在谈事件专题推荐理由:现在你可以把 Devin 跑在自己的 GPU 上了,NVIDIA Brev 直接集成了 Outposts,写代码调试都更方便。原文稍后读已读值得跟进有用关注 Devin
02:49OpenRouter@OpenRouterAIPoolsideAI 发布了开放权重的 Laguna S 2.1 模型,采用 118B-A8B 混合专家架构。该模型拥有 1M 上下文窗口,专门用于智能体编码和长时任务。在 Terminal-Bench 2.1 基准上得分 70.2%,在 DeepSWE 上得分 40.4%。模型现已通过 OpenRouter 平台提供使用。AI模型Laguna S 2.1PoolsideAIOpenRouter推荐理由:PoolsideAI 出的 Laguna S 2.1,118B MoE 带 1M 上下文,Terminal-Bench 上 70.2%,专搞编码智能体,想试试直接去 OpenRouter 用。原文稍后读已读值得跟进有用关注 Laguna S 2.1
02:22宝玉@dotey81°Google发布了Gemini 3.6 Flash、3.5 Flash Lite和3.5 Flash Cyber三款新模型。Gemini 3.6 Flash输出定价从每百万token $9降至$7.5,生成速度达304 tokens/s(前代165 tokens/s),在Artificial Analysis Index上平均少用17%输出token。OSWorld-Verified计算机使用能力从78.4%提升至83%,知识工作基准GDPval-AA得分从1349升至1421。3.5 Flash Lite定价$0.30/$2.50适合高吞吐场景,3.5 Flash Cyber专注网络安全。Gemini 3.5 Pro仍延迟发布,仅对部分合作伙伴开放。AI模型GeminiGemini 3.6 FlashGoogle10 个信源在谈事件专题推荐理由:Google新出的3.6 Flash更便宜更快还省token,Agent工作流速度翻倍,编程助手场景很合适,推荐试试。原文稍后读已读值得跟进有用关注 Gemini
02:14Cognition@cognition_labs精选72°Cognition宣布Devin Outposts可在NVIDIA Brev上部署。这一集成使Devin能够访问GPU基础设施,用于调试训练运行、检查GPU状态、重现故障,并在实际硬件上验证修复。部署入口位于brev.nvidia.com的launchable页面。该方案面向需要GPU调试的AI工程团队。技巧DevinNVIDIA BrevGPU3 个信源在谈事件专题推荐理由:Cognition把Devin Outposts搬上NVIDIA Brev,让Devin能直接动用GPU来定位训练bug、检查显存状态,不用自己搭环境。原文稍后读已读值得跟进有用关注 Devin