论文11:42RA-RFT:通过检索增强强化微调实现类比推理做复杂推理的AI研究者终于有了一个不依赖语义相似度的检索框架——RA-RFT让模型学会类比推理,数学基准提升显著,做RAG或强化微调的团队值得关注。#检索增强生成#类比推理#强化微调#数学推理aarXiv cs.AI@Zilin Xiao 等 7 人原文稍后读已读值得跟进有用关注 检索增强生成