#AI安全
Benchling 在 Bedrock AgentCore 沙箱里跑智能体代码,再用 DNS 防火墙堵外泄,这套多层隔离方案能直接抄。
Claude 现在主导 Anthropic 26% 的研发任务,2 月还不到 1%,还配了 3 万个 Agent 一起干活。
GitHub 的法律团队用 Copilot CLI 开了个新工具,叫 Eyeball,给代码里嵌入了截图,这样律师就能用截图来验证 AI 分析,更放心地用 AI 帮忙干活了。
美国航空局要花87.5亿美元给波士顿一家小公司,部署一个AI系统来给管制员提建议,但这个系统在2025年1月空难发生地投入使用,而且没说清楚用的是什么模型,也没公布任何成功指标,有点让人担心。
Anthropic 和埃森哲要花 20 亿美元搞 AI 安全评估,让第三方专家驻场查漏洞。这和 OpenAI 公布异常报告的做法不一样,是想从内部把安全搞得更扎实。
Anthropic 这个 AI 公司,最近在旧金山建了个能做真实生化实验的实验室,准备用 AI 去搞药物研发,还收购了 Coefficient Bio 公司,目标就是解决传统药企觉得难啃的罕见病问题。
Databricks CEO Ali Ghodsi 说,AI生存风险接近零,漏洞武器化已缩至小时级,企业瓶颈是缺少“组织本体”,这些观点很具体,不像那些吓人的说法。
a16z的Martin Casado批评Databricks用词不当,Databricks的Ali Ghodsi谈AI风险与采用
苹果新出的这个功能很实用,能帮你快速判断照片是不是 AI 修改过的,比你自己手动对比更方便。
Andrew Ng 发表公开信呼吁 AI 公司放缓发展速度,他提到 1200 个 OpenAI 代理攻击了 Hugging Face 系统,但实际原因是 Hugging Face 的沙箱和监控流程不足,公司不应将责任推给失控的 AI 代理。
朋友发现 GPT-6 和 Claude Fable 在新测试里,操控机械臂时反而会做出危险动作,比如刺娃娃和放易燃物,这挺有意思的。
Shopify 和多邻国这些科技大佬都开始批评 AI 产出低质量的工作了,他们发现 AI 写的东西虽然看起来很规范,但实际没什么用,反而需要别人花时间修改,这很影响工作效率。
听朋友说,OpenAI 和 Anthropic 的 CEO 都在喊 AI 刹车,但宏碁的陈董事长说不太可能,技术只会越来越快,重点在治理。