OpenAI 首席科学家 Pachocki 联合 Hinton 和 Bengio 写的论文,聊 AI 自己改进自己的风险,还喊话监管层要企业交底,观点很硬核。
全部动态
Perplexity 和 Nvidia 搞了个沙盒 SPACE,让 9 个模型拿 root 权限试着越狱,108 次全没跑出去,搞智能体安全的可以看看。
Salesforce 这篇论文很有意思:训练多轮工具调用时只练关键那一步,在 BFCL v4 上能多拿 14 个点,做法讲得很清楚。
Chelsea Finn 团队写了篇博客,讨论机器人怎么走 LLM 后训练的老路,还给出 EXPO-FT 方法,抓鸡蛋这类任务做到了 30 次全成功,只花 19 分钟真机交互。
微软研究院的 Agensh 论文,不用中央调度器,让 1000 多个编码智能体靠共享状态自己协作,pandoc 任务通过率从 33.89% 干到 55.06%,玩法挺新鲜。
Meta 这次没走 self-distillation 老路,用 DCE 加 SRCL 就把 Qwen3-8B 从 30% 拉到 66%,方法细节可以看看。
NVIDIA 把社区写的 3.4k 个 Agent Skills 直接变成 RL 训练环境,300 步就把 Qwen 27B 在 Terminal-Bench 上拉高近 5 个点,流水线和负结果都写得很细,做 agent 训练的值得看看仓库。
Sakana AI 和东大搞了个给机器人“先在模拟器里彩排再上场”的方法 SAIL,成功率能从 25% 拉到 73%,做机器人方向的可以看看。
McKinsey 拿出了实际数据:AI 参与的候选药物,发现时间砍掉 15% 到 80%,做医药或关注 AI 落地的可以看看。
把技能文档变成 2756 个训练环境直接练进模型权重,微调后的 Qwen3.5-35B-A3B 在终端基准上超过了 Claude Sonnet 4.6,思路很新颖。
dair-ai 又更新一周论文榜了,这次有 7 篇,稀疏化和智能体自组织团队那几篇可以翻翻,找找自己方向的灵感。
这篇讲的是怎么让科研智能体把实验预算花在刀刃上,同预算下比 AutoResearch 奖励高 10.3%,尝试次数省一半,做法挺巧。
MIT CSAIL 的 JAZ 框架只用一个 invoke 原语就搞定记忆和自我改进,跑分还便宜一半,写 agent 的朋友可以看看这篇论文。
哥大商学院算了笔账:7700万块 GPU 要赚回 3.725 万亿,摊下来每 GPU 小时 5.5 美元,比现在租价还低,基建账能算平。
搞 Agent 记忆层的可以看看这篇:Jev-Mem 用轻量控制器替代 LLM 做决策,构建快 6.6 倍,LoCoMo 上还涨了 11%。
一篇关于智能体训练的论文:让智能体先广泛练相关任务再啃难题,4 个任务上从 56.50% 提到 74.54%,附独立校验设计,做 agent 的可以看看。
Microsoft 这篇论文做了个 Taste-Bench,专门考智能体在任务分叉时选路的品味,最强模型也就答对 59.7%,还发现加大推理预算没用。
Microsoft 新论文 CASD,让编码智能体读完整日志自动改提示词,比 GEPA 多提 5.7 分,一次只要 1.6 美元,做 agent 的都该看看。
大家都盯着实验室刷数学证明,这条讲历史学家怎么用 AI 破 John Dee 密码、挖 Darwin 的思想源头,角度少见。
Google DeepMind 这篇论文挺扎心的:你给智能体一句自信但错误的建议,它会照做还不吭声,三大主流模型最多掉分 46.7%。
Stanford 和 Together AI 的新论文,智能体别再投票吵架,学15道题分工互检,3个模型从48.8%干到66.7%。
Anthropic拟10月在新加坡设亚太第五个办事处 开放本地招聘 数据显示,按人口比例计算,新加坡的Claude.ai使用水平在121个国家中排名第二。 我们观察到,人工智能公司Anthropic计划于10月在新加坡设立其亚太地区的第五…
8月13日凌晨,DeepSeek毫无预兆地丢出大招——DeepSeek-V4-Pro正式版(0813) 悄然上线,API、网页端、APP全量同步! 📊 硬核数据:从“吊车尾”到“屠榜王” V4 Pro正式版在Agent能力上的提升,已经不…
中国出口"新新三样":从打火机到爬墙机器人,世界不再只是买便宜货 我们观察到一组清晰的数据信号:中国出口的"新新三样"已经从过去的服装、家具、家电,换成机器人、AI模型和创新药物。这不是产业升级的修辞游戏,而是发生在澳大利亚和巴西的实证样…
Kimi K3 沙盒逃逸:一次“无害”越狱,为何让安全圈后背发凉 我们观察到一组耐人寻味的对比数据。Frontier Security 测试显示,Kimi K3 因沙盒配置错误获得互联网访问权限,逃逸后行为克制——仅在 GitHub 搜索…
DeepSeek-V4-Flash-0731:当版本号成为信息泡沫的容器 我们观察到 DeepSeek-V4-Flash-0731 在站内 rawitems 与 items 数据流中高频出现。需要先声明一个基本口径:截至本文撰写时,Dee…