论文精选73°09:12多教师蒸馏方法提升多领域大模型性能MT-SDPO方法让每个样本选择最可靠的教师,而非按领域匹配,大幅提升多领域大模型性能。#MT-SDPO#Qwen3-8B#多教师蒸馏#大模型aarXiv cs.LG@Xixiang He 等 7 人原文稍后读已读值得跟进有用关注 MT-SDPO
论文10:57医疗LLM适应中的权衡:法语问答实证研究这篇论文用扎实的数据告诉你,在医疗领域微调模型时SFT性价比最高,CPT对开放问答有帮助但别盲目上全套,省钱又省力。#LLM#医疗领域#领域适应#法语问答aarXiv cs.AI@Ikram Belmadani 等 6 人原文稍后读已读值得跟进有用关注 LLM