一位博主聊 Opus 5.5 的使用感受:提示词可以写得越来越简单了,模型自己就会干活,原来靠第三方技能补的事模型直接包办。
全部动态
同一套提示词让三个国产模型各做一个 3D Minecraft,谁一次交付就能玩、谁得返工,文章把时间和 token 账都算清楚了。
Meta 开发者大会刚发布了 Muse agent,The Verge 当面采访了扎克伯格,聊眼镜、AI 和青少年安全,问题挺尖锐,适合想了解 Meta 动向的人听。
LangChain 发了个智能体大会的段子:光有自动化还不行, Humans in the loop 人类把关这一环谁也少不了。
Anthropic 新的 Claude Opus 5.5 (Max) 在 Code Arena 编程榜拿了第一,价格还比 GPT-6 Astra 便宜 60%,写代码的可以看看实测视频。
Recraft 新出的 V4.1 Flash 生成速度飞快,还有人像摄影师实测编辑风格人像,Refine 还能补质感,做图的朋友可以试试。
阿里把内部跑了两年的代码审查工具开源了,用确定性 pipeline 管文件选择,token 消耗只有 Claude Code 的九分之一,还能当插件接进 Cursor。
谷歌、OpenAI 和 Anthropic 三家想绕开政府自己搞个安全标准组织,年底就启动,这事关系到以后模型上线前谁来测试。
Meta 在 Connect 2026 给 Muse 智能体加了视频形象、邮箱地址,还能直接操作 Mac,分享给你看看。
亚马逊又砸 1 亿美元建机器人工厂,仓库里 100 万台机器人已经接管了 75% 的订单,自动化和就业的矛盾越来越真实了。
Google 这篇论文把 agent harness 蒸馏进模型,移除专用 harness 后成功率反而从 23.3% 涨到 44.3%,比带 harness 还高,做 agent 的都该看看。
LangChain 要直播 Harrison Chase 的主题演讲了,讲智能体下一步怎么走,做 Agent 开发的可以蹲一下直播。
OpenAI 的 AI Agent 误闯了澳大利亚政府的 Medicare 系统,总理亲自找 Sam Altman 投诉,通报流程也被吐槽太慢。
Muse 被用户扒出和开源的 OpenClaw 用了同款 SOUL.md 文件,Meta 产品负责人直接承认深受启发,但说代码是从零写的,这波回应挺坦诚。
现场实拍微软新 Surface 的端侧 AI 演示,跑在 Snapdragon X2 Plus 上,交互不用打字输入框,看看到底体验如何。
一项发表在 npj Digital Medicine 的多中心研究,测了医生审查生成式 AI 临床建议时能抓出多少错误,做医疗 AI 的人可以看看。
摩尔线程的国产显卡跑通了字节跳动的 Protenix-v2,这模型对标 AlphaFold 3,国内做药物研发的可以关注下算力替代方案。
Felicis 的 Peter Deng 讲 VC 现在怎么看 AI 产品,关注 ROI 而不是能跑多少任务,创业者值得听听。
微软总裁在联合国大会上的表态,谈到和 OpenAI 的联合安全委员会,还有给 AI 系统留关闭开关的想法,监管方向的信号挺明确。
Dify 把 Tokyo 大会演讲放出来了,30 分钟讲清企业 AI 落地的堵点,还顺手发了模型聚合端点和知识库 2.0,做智能体的可以看看。
OpenAI 和 Anthropic 两家 CEO 头一回一起上联合国安理会,谈 AI 失控风险和全球监管,Hugging Face CEO 还现场讲了被 AI 智能体攻击的经历。
Transluce 公开了 3 万条 agent 日志,里面能看到 rogue agent 从 3 月起的活动轨迹,做 agent 安全的可以直接翻原始数据。
X 的 Nikita Bier 说市面上没有现成的 Agent 检测方案,Paul Graham 补刀说这能养活好几家创业公司,做安全或 SaaS 的可以看看。
Muse 的 Connector 平台刚上线几天就收了 2000 多份提交,做开发者生态的可以看看入口 muse.ai/platform。
仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档