8月7日
11:39
11:39官方账号arXiv cs.AI@Mutasim Fuad Sarker, Adiba Rahman Namira, Wafa Binte Alam, Md Adnan Arefeen, Mahzabeen Emu, Sumaiya Tabassum Nimi
QuanTiMedAI结合智能体LLM与量子循环网络,构建心脏骤停死亡风险预测模型。在MIMIC-IV心脏骤停队列上,模型仅用605个参数达到AUROC 0.852,较当前最先进基线提升约2.9%。智能体LLM引导的特征选择优于传统方法,量子非线性增强则让模型以极少参数取得竞争力。
推荐理由:这个QuanTiMedAI挺有戏:605个参数就把心脏骤停死亡预测AUROC做到0.852,比原来最好的还高2.9%。
09:42
09:22
09:22官方账号arXiv cs.AI@Saugat Adhikari, Ashok Prasad Neupane, Pramish Paudel, Ajad Chhatkuli, Danda Pani Paudel
iARCS 框架用迭代智能体强化学习,让预训练场景生成器适配自然语言任务要求。它采用两阶段策略:先用通用奖励预训练提升物理合理性,再用 LLM 生成的奖励程序做任务特定微调。实验在可步行性、可达性和间隙约束任务上提升了约束保真度,同时场景多样性保持竞争力。iARCS 生成的数据还能反过来改进基础生成器。
推荐理由:iARCS 用强化学习让 3D 场景生成器听懂自然语言要求,走路、够东西这些约束都能满足,还能提升基础生成器。
09:16
07:11
07:11Jerry Liu@jerryjliu0
AI初创公司Explabs AI今日在Y Combinator(YC)正式上线。该公司宣称其自动化服务可将AI成本降低最多97%,同时质量提升50%。该服务基于hillclimbing(爬山算法),面向任意agentic任务。创始人Silen Naihin是AutoGPT项目早期参与者。
推荐理由:Explabs AI上线YC了,做AI任务自动化优化的,说成本能砍97%、质量还能涨50%,听着挺猛,来瞅瞅。
05:44
05:40
05:40官方账号Cursor@cursor_ai
83°
Cursor现已支持Agent Plugins,这是Vercel推出的开放标准,用于捆绑技能与MCP服务器。该标准可让不同AI代理共享同一套插件,首批合作方包括AWS、Code、GitHub和OpenAI。Cursor用户可直接通过Agent Plugins扩展功能。
事件专题

推荐理由:Cursor现在能装Agent Plugins了,技能和MCP服务器可以打包跨工具用,Vercel联合了AWS、GitHub、OpenAI一起推。
04:51
04:46
04:46官方账号Perplexity@perplexity_ai
Perplexity发布新子代理Terra,专为复杂目标导向任务设计。在WANDR基准测试中,Terra得分比Sonnet高11分。同时,其运行成本降低了一个数量级。另一款子代理Luna则面向追求速度和成本效益的重复性工作流。

推荐理由:Perplexity出了两个新子代理,Terra跑复杂任务比Sonnet强11分,成本还省十倍,日常活儿可以交给Luna。
04:45
04:45Aravind Srinivas@AravSrinivas
Perplexity Computer宣布GPT 5.6 Terra和Luna正式上线。CEO Arav Srinivas称,团队对GPT 5.6 Terra进行了大量测试,认为其在能力与成本间表现均衡。Terra现成为Perplexity Computer所有子代理的默认模型,并作为编排模型向所有Computer用户开放。Luna则承担计划自动化任务。
事件专题

推荐理由:Perplexity把GPT 5.6 Terra设成电脑助手默认模型,便宜又够用,子代理和编排都能用,想低成本体验多模型可以试试。
04:14
04:14官方账号Perplexity@perplexity_ai
Perplexity Computer 现已上线 GPT 5.6 Terra 和 Luna 两款新模型。Terra 成为所有 Computer 子代理的默认模型。Luna 则作为计划自动化的主要模型。Terra 也可作为编排模型使用。
事件专题

推荐理由:Perplexity 把 GPT 5.6 Terra 和 Luna 放进 Computer 了,子代理默认用 Terra,自动化用 Luna,编排也能选 Terra。
03:24
03:24官方一手AWS Machine Learning Blog@Sean Eichenberger
Amazon Bedrock AgentCore 新增时间策略功能,允许开发者根据代理的会话历史定义有状态规则。该机制可强制工作流顺序执行,防止模型编造数据。它还能设置财务支出上限,并对高价值操作要求人工审批。官方博客用示例演示了具体配置方法。
推荐理由:AWS 给 Bedrock AgentCore 加了时间策略,能按会话历史控制智能体行为,防乱序、防编数据、还能限金额和加人工审批,搞 Agent 安全的可以看看。
02:45
02:45向阳乔木@vista8
用户实测bb Agent框架,安装后无需任何配置即可自动识别本机装有的Codex cli、Grok Build cli、Claude Code cli和PI Agent。该框架支持在多个模型之间自由切换,官网宣称其IDE具备“自进化”能力。用户对产品经理的设计表示认可。

推荐理由:朋友,bb这个Agent框架装完就能自动认出你电脑里的Codex、Claude Code这些CLI,模型随便切,连设置都不用,有点东西。
02:15
02:15Notion@NotionHQ
Notion官方介绍了Q&A agents功能,它能在Slack中回答来自Notion文档或已连接工具的重复问题。该代理会随信息变化自动更新文档来源,保持答案新鲜。官方称该功能第一天就能发挥作用,许多团队因此将其作为起点。
事件专题

推荐理由:Notion出了Q&A agents,在Slack里直接问,它从你的文档找答案,还会自动改旧信息,省得你一个人翻文档。
01:47
01:47官方账号LangChain@LangChainAI
LangChain Academy更新了Intro to Deep Agents课程,新增动态和异步子代理模块。课程加入Course tutor技能,可将编程代理变成个人导师。提供Capstone项目和练习,并支持TypeScript。更新基于Deep Agents v0.7版本。
推荐理由:LangChain官方课程更新了,教你玩Deep Agents的子代理和导师功能,有项目练手,还支持TypeScript,想搞智能体的可以冲。
01:41
01:41官方账号Decoder@Matthias Bastian
Composio在30个真实任务上测试了DeepSeek V4 Flash在四个agent框架中的表现。各框架成功率相近,但成本相差近3倍。OpenCode每任务成本最低,为$0.073,而Claude Code高达$0.195。Claude Code使用最少的工具调用和输出token,但价格最高。框架选择主要取决于价格和速度。
事件专题

推荐理由:实测四个框架,OpenCode每任务只要7美分,Claude Code要19美分但速度最快。想省钱选OpenCode,追求速度就选Claude Code。
00:47
00:47官方一手@OpenAIDevs@OpenAIDevs
精选
OpenAI与AWS、Cursor、GitHub、Vercel联合发布Agent Plugins开放标准。该标准将Agent Skills打包为共享格式,并支持MCP服务器配置。开发者只需构建一次插件,即可在多个兼容的agent客户端中运行。
事件专题

推荐理由:写一次插件就能在Cursor、GitHub这些地方用,OpenAI联合几个大厂搞了个开放标准,省得每个平台单独适配了。
00:46
00:46官方一手@OpenAIDevs@OpenAIDevs
OpenAI Devs 发布了一条推文,内容为“发布时兼容的智能体客户端”,并列举了 Codex、ChatGPT、Cursor、GitHub Copilot、kirodotdev 和 code agent-plugins.org。推文提到这些客户端将在上线时即获得兼容支持。这条消息目前获得了 4 条回复、2 次转发和 17 次点赞。
事件专题

推荐理由:OpenAI 一口气列了六个兼容客户端,包括 Cursor 和 Copilot,搞智能体开发的朋友可以看看有没有你用的。