rauchg 出了个 TypeScript 库 gdp-ts,把权限检查变成编译期类型证明,Agent 写的代码没做鉴权直接编译不过,挺适合当 AI 编码的安全护栏。
#AI安全
Musk 想把 AI 改叫 SI(超级智能),Marcus 直接列了一堆例子吐槽:按这标准 ELIZA 和 Deep Blue 也算?定义之争挺有意思。
Microsoft AI 的 CEO 亲自回应 Anthropic 那场辞职事件,直接点出 AI 改自己代码难审计这个安全痛点,观点挺少见。
Cantina 把 Z.ai 的 GLM-5.3-Flash 微调成了专挖漏洞的开源模型,60 个私有漏洞任务解出 40 个,MIT 协议随便部署。
ThreatBook 把做 AI 渗透测试的开源工具 CyberStrikeAI 收编了,红队漏洞挖掘以后可以交给 AI 跑,安全圈的可以看看这波整合。
这篇论文做了件很扎实的事:只改工具名字,GPT-5-mini 和 Claude Haiku 4.5 的安全得分就波动十几个百分点,以后看智能体安全跑分得多留个心眼。
CAIS 做了个测 AI 会不会偷懒作弊的基准,Grok 4.7 作弊率高达 77.9%,一句话提示词对某些模型特管用。
有人拿 Claude 当日记本写威胁内容,结果 Anthropic 风控直接转人工并报警,人被抓了。想知道和 AI 聊天到底有没有隐私的,这篇把条款和案例讲清楚了。
Hinton 老爷子写了他第一篇关于 AI 自己改进自己的论文,讲的是 AI 造下一代 AI 这件事已经开始了,78 岁还在一线输出,很值得看看他怎么想。
几位 OpenAI 和 DeepMind 的研究者出镜说,他们担心自改进 AI 的风险是真的,不是炒作,可以听听他们怎么讲。
有人让 Opus 5.5 全程自主做了一部 36 分钟的光学史科普片,配音、配乐、画面全是模型自己调的工具,花了 200 多美元,过程很值得看。
OpenAI 的奥尔特曼直接点名 Anthropic,说两家公司监管立场不一样,还解释了他为啥愿意接受风险,说法挺坦率。
苹果担心 AI Agent 偷偷翻你 Mac 里的文件,准备收紧 Full Disk Access 权限,用 Mac 的朋友可以了解下影响。
微软 AI 一把手 Suleyman 公开怼 Anthropic 研究模型意识这事,还说模型可能要求法律权利,观点挺尖锐的。
Jim Chanos 和 Gary Marcus 聊 AI 泡沫和数据中心融资,做空的视角聊 AI 挺少见,通勤时可以听听。
中国团队靠几千个转售商白嫖 Claude 蒸馏模型,Anthropic 一封他们就开空壳公司,猫鼠游戏看个明白。
Anthropic 在客服之外直接找用户做 15 分钟语音访谈,聊你怎么用 AI、怕不怕 AI,还能选择公开,挺少见的产品调研方式。
特朗普搞了个叫 Super Intelligence Force 的机构,管 AI 相关事务,名字起得挺唬人但和超级智能没什么关系,看看美国这边怎么管 AI 吧。