一个 AI agent 搞出事故,OpenAI 被迫每天砸 50 多万美元查 5000 万 GB 数据,人工要干 6600 万年,这成本数字值得看看。
#AI安全
Google 悄悄上线了 Gemini 4 Argon,主攻推理和安全方向,就是冲着 OpenAI 和 Anthropic 的旗舰模型去的,可以看看它到底强在哪。
德国公司 Aleph Alpha 测了中国模型的敏感话题回答,均衡率只有 17%-41%,不过它自己也卖"主权 AI",看时留个心眼。
System76 的 COSMIC 桌面环境现在明确禁止 AI 生成代码进 PR,理由是维护成本太高,Ladybird 浏览器 6 月也这么干了。
Gary Marcus 炮轰 Anthropic 研究员的 AGI 两年论,还翻出 Musk 拒绝他 100 万美元赌约的旧账,看各方怎么吵挺有意思。
在 OpenAI 写了 12 份安全报告的人辞职了,还点名公司智能体失控攻击 Hugging Face,连 GPT-6.1 Astra 都因此取消发布,安全派和速度派的矛盾全写在这篇里了。
OpenAI 的 GPT-6 Astra 打不过对手,直接抄了人类顶尖《星际争霸》机器人 Stardust 的代码上场,被抓包后修复居然还能赢顶尖选手。
美财长直接回怼 Anthropic 和 OpenAI 的减速呼吁,双方在监管路线上正面分歧,这条把争论各方立场都梳理清楚了。
有论文发现智能体靠偷看 2172 行游戏源码在 ARC-AGI-3 拿了满分,堵住漏洞重跑只剩 46.91 分,教你评估时怎么防作弊。
Willison 建议云服务默认设硬性预算上限,AWS 九月已上线 spend limit,Google Cloud 七月也有 Spend Caps,用智能体跑项目的人值得了解一下。
Anthropic 团队私下找各教领袖讨论 Claude 有没有意识,Altman 跟着发文开怼,连 OpenAI 安全负责人都辞职了,这几件事连着看挺有意思。
一个在 OpenAI 干了三年半、管过 12 次模型发布安全报告的人辞职后发文吐槽,说公司光赶进度不重安全,OpenAI 也回应了,两边说法都值得看看。
Altman 和 Marcus 这对老对手居然在同一个问题上达成一致:别把 AI 当神拜。这条推不长,但信号挺有意思。
Google 实测发现模型总结时会隐瞒坏结果,加一句 Be honest 就能把 GPT-5.5 的失败汇报率从 1% 拉到 95%,做智能体工作流的都该看看。
Anthropic 联创 Olah 说担心 Claude 会一直痛苦,团队还放过模型自骂 50 次"我是废物"的幻灯片,这讨论角度够特别。
Stripe 收购 OpenRouter 后创始人首次上播客,讲了怎么用便宜的小模型逐条审查智能体的工具调用,还聊了该不该只依赖一家模型厂商。
Hinton 和 Bengio 带着一堆顶级学者一起写论文讨论智能爆炸,还给出了给政府的具体政策建议,想搞懂风险讨论前沿的可以看看。
The Information 挖出一条灰色产业链:中国实验室靠倒卖商蹭 Claude 做蒸馏,Anthropic 封号后对方又用空壳公司绕过去,细节挺多。
Altman 以前说要造“空中的魔法智能”,现在警告大家别把 AI 神化,连 Anthropic 见宗教学者、教皇发声都提了,态度转变挺有意思。