论文10:56PoPE方法评估冻结小模型自修复:错误内容未显著提升修复率这篇论文用严格安慰剂对照方法戳穿了代码模型自修复的假设,在0.5-1.5B模型上实测发现错误内容并没带来明显改善,想了解模型能力边界可以看看。#PoPE#代码生成#自我修复#小型模型aarXiv cs.AI@Mehmet Iscan原文稍后读已读值得跟进有用关注 PoPE