论文10:43Unfireable Safety Kernel: AI智能体执行时安全对齐这篇论文用Rust和形式化验证搞了个安全内核,1000次自修改加6240次授权测试都拦住了逃逸,比那些吹控制智能体的系统实在多了。#Unfireable Safety Kernel#AI Agent#安全对齐#形式验证aarXiv cs.LG@Seth Dobrin, Łukasz Chmiel原文稍后读已读值得跟进有用关注 Unfireable Safety Kernel