GitHub 基于上亿条真实 PR 做了个 ReviewBench,能测你的 AI 代码审查工具是不是只会刷评论,自己动手就能跑。
#代码审查
GitHub 做了个专门测 AI 代码审查能力的开源基准 ReviewBench,用真实 PR 和生产对齐的指标打分,做代码审查工具的可以拿来自测。
Cua 的 Francesco Bonacci 讲怎么放心让智能体整夜写代码,低质量 PR 怎么处理、为什么补丁不能直接合并,做智能体编程的可以听听。
GitHub 官方出了个教程,用 Copilot 自动把一堆 Dependabot 依赖 PR 按风险分组、查 CI、写摘要,每天上班前自动跑一遍,维护老项目的人可以试试。
CodeRabbit 出了个 Change Stack,能把一个 PR 的改动分层讲清楚,还告诉你影响范围,review 前先看它省不少劲。
Garry Tan 亲测 Capy 做 code review,说比自己直接用 Codex 和 Claude Code 快至少 4 倍,还贴了真实 PR 例子,做工程的朋友可以看看。
GitHub Podcast 这期专门回应了三个大家争论的点:AI 代码要不要人工审查、RAG 是不是没用、Skills 有没有取代 MCP,想搞清楚这些说法的对错可以听听他们的分析。
GitHub 的法律团队用 Copilot CLI 处理了 100 万行代码,帮你快速检查代码里的法律风险,比如开源许可证问题,比手动查快多了。
程序员朋友要注意,行业趋势显示 IDE 在衰落,Token 最大化不再被追求,AI 生代码多到没法审查,开源模型能省不少成本。
SonarSource 新版 SonarQube 用 GPT-4 做代码审查,比以前更智能,能帮你发现更多安全漏洞。
这篇论文提出了一个名为PRGuard的新工具,用于评估自动代码审查工具在拉取请求中的安全价值,与现有工具相比,它能够更准确地识别目标漏洞,值得一看。
Cursor Team Kit 新增 "Thermo-Nuclear Code Quality Review" Skill,帮你提升代码质量,对抗 AI 代码生成问题,是审查 PR 的利器。