论文12:15MineValiCoder:基于测试用例质量挖掘与二分图互验的可靠代码生成这篇论文用MineValiCoder框架搞定代码生成不可靠问题,HumanEval跑出96.34%通过率,比之前的方法强一截,搞LLM代码的同学值得看看。#MineValiCoder#测试驱动开发#代码生成#HumanEvalaarXiv cs.AI@Zhen Zhao 等 5 人原文稍后读已读值得跟进有用关注 MineValiCoder
论文10:08掩码感知策略梯度提升扩散语言模型推理能力这篇论文给扩散语言模型加了个策略梯度法子,数学推理和编程测试成绩都刷了新高,搞RL训练模型的可以看看。#MDLM#扩散语言模型#策略梯度#GSM8KaarXiv cs.AI@Haran Raajesh 等 4 人原文稍后读已读值得跟进有用关注 MDLM