主要来源arXiv: DeepSeek
查看原文事件专题 · 官方一手
CodeSpec:面向智能体长周期特性开发的双可执行规范方法
CodeSpec提出双可执行规范方法,从子需求语义与仓库架构配对构建可靠功能链,并编译为互补的架构和行为规范。在FeatureBench上,使用DeepSeek-V4-Pro达到70.7%、55.0%和49.9%的通过率,优于Claude Code等基线。在NL2Repo-Bench上验证了泛化性。该方法通过可执行规范保证长周期开发中设计与实现的一致性。
当前结论
这篇论文搞了个CodeSpec,让代码智能体在仓库里加新功能时先建可执行规范,在FeatureBench上用DeepSeek-V4-Pro跑到70.7%通过率,比Claude Code靠谱不少。
5 个信源58° AI 热度最后更新 2026/7/29 11:20:49
证据链
相关来源 1IT之家
查看原文相关来源 2orange.ai
查看原文相关来源 3Geek
查看原文相关来源 4深度求索 DeepSeek
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。