论文Agent 与开发者09:59研究剖析 83 个智能合约审计 Skill 的设计与实际效果有人收集了 83 个智能合约审计 Skill 做系统评测,发现效果主要看模型,Codex/GPT-5.5 检测分提升 22.8%,还开源了语料,做 agent 开发的可以看看。#Claude Code#OpenAI Codex#EVMBench#智能合约审计aarXiv: OpenAI@Cuifeng Gao 等 5 人原文稍后读已读值得跟进有用关注 Claude Code