Claude Opus 5 刷榜 ARC-AGI-3,蒸馏论战白热化
2026年7月27日,AI领域聚焦Claude Opus 5在ARC-AGI-3上取得30.2%(接近GPT-5.6 Sol的4倍),其1511行系统提示词意外泄露。同时,模型蒸馏争议升级:黄仁勋公开支持蒸馏作为学习基础,而OpenAI与Anthropic游说限制中国开源模型,三星与OpenAI探讨HBM合作。在智能体编程方面,Cursor引入规划者/执行者分离(Agent Swarm),快手KAT-Coder-V2.5在10万环境中训练,Agent Skills调用机制优化为单步完成。此外,卡帕西删除Anthropic简介引发离职猜测。
模型发布/更新
5 篇快手开源了KAT-Coder-V2.5,用10万个可验证环境训练代码智能体。AutoBuilder把环境搭建成功率从16%拉到57%,沙盒审计又让反馈错误降到2%以下。做编程智能体训练的值得一看。
SemiAnalysis证明Kimi K3比NVIDIA的Nemotron 3 Ultra强很多,开源AI竞争格局正在变化,看看谁在领跑。
Induction Labs 搞了个新套路:不用动作标签,只看视频就能学会模拟桌面、跳棋和台球物理。106B 参数的 MoE 模型,一次预训练就够了。
产品发布/更新
4 篇腾讯这个Miora设计智能体,你给个品牌brief,它就能自己画出logo、VI、海报甚至视频,一条龙服务,挺省心的,不过还不能和其他工具打通。
行业动态
5 篇SK集团砸5000亿美元和英伟达建AI工厂,2027年用HBM4和Vera Rubin,这规模前所未有,想了解巨头怎么布局的可以看。
硅谷大佬站队了:OpenAI和Anthropic想限制中国开源,黄仁勋、马斯克、扎克伯格公开反对。看他们到底在争什么。
Google用Rust重写Android关键代码后,内存安全漏洞从76%掉到24%,这组数据很直观,告诉你迁移到安全语言有多值。
论文研究
3 篇Opus 5 的提示词被完整扒出来了,3.4 万 token 全是规矩,连记忆怎么记、什么能记不能记都写死了,看完你就知道 Anthropic 有多谨慎。
技巧与观点
3 篇Wang 分享了他用 GPT-5.6 Sol 解数学难题的完整工作流,你不需要是数学家也能跟着做,关键是那些提示词套路。