AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

Agent-SafetyBench

共 1 条相关 AI 资讯
8月10日
11:30
11:30官方一手arXiv: OpenAI@Aditya Katkar, Om Karkele, Kartik Mandhane, Manisha More, Yash Kashid
NiyamAI框架将允许的工具和约束通过SHA-256锁定为Intent Contract。每次工具调用由隔离的Judge模型校验,通过后生成zk-SNARK证明,验证成功才执行。在Agent-SafetyBench的2,000个场景中,NiyamAI的F1分数为88.5%,假阳性率1.1%。与NeMo Guardrails相比,在390个不一致场景中获胜,仅输20个。每次批准操作平均增加2260.6毫秒证明生成时间,验证需53.1毫秒。
论文NiyamAIAgent-SafetyBench零知识证明

推荐理由:NiyamAI给AI Agent装上了密码学护栏,每个危险操作都能被证明拦住了,比传统过滤靠谱。
原文
精选全部日报登录