RAPO-Sol:检索增强偏好优化用于仓库级 Solidity 代码生成
一篇做 Solidity 代码生成的训练方法论文,思路挺有意思:训练时检索、推理时不检索,再用语义扰动造 DPO 数据,Qwen2.5-Coder 等模型上验证有效。
一篇做 Solidity 代码生成的训练方法论文,思路挺有意思:训练时检索、推理时不检索,再用语义扰动造 DPO 数据,Qwen2.5-Coder 等模型上验证有效。
针对智能合约代码生成难保语义一致的问题,这篇论文用 RAFT 加 SAP 扰动构造的 DPO,在 SolidityBench 上让三个 7B 级模型都拿到了最好成绩,做合约生成的人可以看看方法细节。
这篇论文为Solidity智能合约代码生成建了个新基准(5470个合约)和专用评分指标,测试了多个主流代码模型的各种方法,结论明确:靠谱的领域数据+微调最管用。