论文Agent 与开发者18:39LoRA微调让小型开源模型胜任数学隐喻编码任务想知道小模型微调后能不能干过大厂API?这篇用2千多条真实学生数据实测,DeepSeek-R1 1.5B微调后比GPT-5 mini还稳。#LoRA#微调#DeepSeek-R1#Mistral 7BaarXiv: DeepSeek@Liang Zhang 等 4 人原文稍后读已读值得跟进有用关注 LoRA