OpenAI 首席科学家 Pachocki 联合 Hinton 和 Bengio 写的论文,聊 AI 自己改进自己的风险,还喊话监管层要企业交底,观点很硬核。
全部动态
Perplexity 和 Nvidia 搞了个沙盒 SPACE,让 9 个模型拿 root 权限试着越狱,108 次全没跑出去,搞智能体安全的可以看看。
Salesforce 这篇论文很有意思:训练多轮工具调用时只练关键那一步,在 BFCL v4 上能多拿 14 个点,做法讲得很清楚。
Chelsea Finn 团队写了篇博客,讨论机器人怎么走 LLM 后训练的老路,还给出 EXPO-FT 方法,抓鸡蛋这类任务做到了 30 次全成功,只花 19 分钟真机交互。
微软研究院的 Agensh 论文,不用中央调度器,让 1000 多个编码智能体靠共享状态自己协作,pandoc 任务通过率从 33.89% 干到 55.06%,玩法挺新鲜。
Meta 这次没走 self-distillation 老路,用 DCE 加 SRCL 就把 Qwen3-8B 从 30% 拉到 66%,方法细节可以看看。
NVIDIA 把社区写的 3.4k 个 Agent Skills 直接变成 RL 训练环境,300 步就把 Qwen 27B 在 Terminal-Bench 上拉高近 5 个点,流水线和负结果都写得很细,做 agent 训练的值得看看仓库。
一群研究者认真测了文档到底能不能帮 coding agent,结果在 10 个仓库上翻车,还公开了打分基准和提示词,做 agent 的人该看看这个负面结果。
3 位小学老师用 ToyTalk 上了 13 天 AI 课,研究者跟全程,总结了他们怎么临场调整教学,做教育 AI 的人能直接参考。
手持视频拍糊了也能重建 3D 场景,这篇 ClearGS 靠加权监督加无参考修复,在 GS2E 和 GSOTM 上跑赢了现有方法。
arXiv 上这篇论文教你把提示词砍到最短还不掉输出质量,还给了三个可操作的压缩框架,写 prompt 的人可以看看怎么省 token。
用 Qwen2.5-VL-3B 在 PMC-VQA 上做了严谨对照实验,发现答案准确率涨了,模型可能反而不看图了,做医疗 VLM 微调的都该看看。
这篇不聊概念,讲一个真实上线的阿拉伯语语音产品怎么搭:6 个 MCP 服务器做检索、自训的 6B 路由模型和 TTS 都开源了,做语音 Agent 的能抄不少作业。
一个新的多智能体协作基准,用 MMORPG 沙盒逼模型跑 50 多轮团队任务,Gemini 3 Flash 也只拿到 52% 成功率,能看清现在模型协作到底差在哪。
一篇讲 LoRA 技能怎么叠加不互相干扰的论文,思路是把新适配器设计成只读旧技能的输入,合并进基座权重还零推理开销,SuperGLUE 比现有方法高了 20 多分。
用 DFA 训网络总卡在常量预测器?这篇论文把根因拆到共模误差和 tanh 饱和,还给了减批量均值这种直接可用的修复办法。
一篇改进 Decision Transformer 的新论文:发现长序列跑崩时预测误差会飙升,先筛掉不可信上下文再选动作,D4RL 上验证有效,做离线强化学习的可以看看。
一篇推理系统论文,解决多模态模型 Encode 阶段拖垮 GPU 利用率的问题,goodput 比 vLLM 高 1.7 倍、比 NVIDIA Dynamo 高 4.3 倍,做 MLLM 服务的可以看看。
Anthropic拟10月在新加坡设亚太第五个办事处 开放本地招聘 数据显示,按人口比例计算,新加坡的Claude.ai使用水平在121个国家中排名第二。 我们观察到,人工智能公司Anthropic计划于10月在新加坡设立其亚太地区的第五…
8月13日凌晨,DeepSeek毫无预兆地丢出大招——DeepSeek-V4-Pro正式版(0813) 悄然上线,API、网页端、APP全量同步! 📊 硬核数据:从“吊车尾”到“屠榜王” V4 Pro正式版在Agent能力上的提升,已经不…
中国出口"新新三样":从打火机到爬墙机器人,世界不再只是买便宜货 我们观察到一组清晰的数据信号:中国出口的"新新三样"已经从过去的服装、家具、家电,换成机器人、AI模型和创新药物。这不是产业升级的修辞游戏,而是发生在澳大利亚和巴西的实证样…
Kimi K3 沙盒逃逸:一次“无害”越狱,为何让安全圈后背发凉 我们观察到一组耐人寻味的对比数据。Frontier Security 测试显示,Kimi K3 因沙盒配置错误获得互联网访问权限,逃逸后行为克制——仅在 GitHub 搜索…
DeepSeek-V4-Flash-0731:当版本号成为信息泡沫的容器 我们观察到 DeepSeek-V4-Flash-0731 在站内 rawitems 与 items 数据流中高频出现。需要先声明一个基本口径:截至本文撰写时,Dee…
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档