02:52Cloudflare Blog@Grant Bourzikas精选Cloudflare博客详解其多阶段漏洞发现工具的技术架构,包括状态控制机制、通过对抗性审查将误报率降低90%的方法,以及如何绕过LLM上下文长度限制(如4k token限制)。该工具实现自动化分类,每日可处理超过10万条告警。文章还公开了其基于GPT-4的分阶段提示词模板和缓存策略。技巧Cloudflare漏洞检测自动化LLM推荐理由:Cloudflare公开了他们内部用的漏洞检测工具怎么做,从状态管理到对抗审查都讲了,想自己搭自动化安全工具的可以抄作业。原文
09:23arXiv: DeepSeek@Zhengxiong Luo, Mehtab Zafar, Dylan Wolff, Abhik Roychoudhury精选Code-Augur提出安全规范优先范式,将漏洞检测智能体的隐性假设显式化为安全规范,并通过运行时反证持续细化。在真实项目上,Code-Augur比Claude Mythos等专用模型检测到更多漏洞。它基于Sonnet和DeepSeek等通用LLM构建,发现了22个关键开源项目的新漏洞。该方法通过模糊测试触发断言,揭示漏洞或修正规范,提升检测可信度。论文Code-Augur漏洞检测智能体安全规范Sonnet推荐理由:这篇论文让AI漏洞检测不再黑箱——Code-Augur会生成明确的安全假设,再用模糊测试验证,已经在真实项目里挖出22个新漏洞,比专用模型还管用。原文
AITOP5月29日 08:02Opus 4.8发布:编程助手的“静默时刻”,是解放开发者,还是新门槛?🔥Anthropic 把 AI 编程的“确认键”彻底删掉了!Claude Code 搭载全新 Opus 4.8 模型,长时间任务不跑偏、不废话、不中断,像一个资深工程师一样默默干活,从功能开发到漏洞清扫全包圆,你在旁边喝茶等结果就行。过去 AI 写代码三步一问“这样可以吗”,现在它直接交完整交付物……自主编程的最后一层窗户纸,被捅破了。做自动化开发和代码审查的团队,这个模型建议直接上手,效率差距肉眼可见……