论文Agent 与开发者10:23ZFO优化框架:大模型微调新方法MIT团队提出ZFO框架,用更少的计算量解决大模型微调步长选择难题,代码已开源。#ZFO#大模型微调#优化算法#语言模型aarXiv cs.LG@Cristian McGee 等 3 人原文稍后读已读值得跟进有用关注 ZFO
论文10:16大模型通过持续预训练适应瑞典新闻业瑞典学者用新闻数据微调大模型,发现经验回放能防止遗忘,提升新闻写作质量。#Swedish journalism#continued pre-training#经验回放#大模型微调aarXiv cs.AI@Lukas Borggren 等 3 人原文稍后读已读值得跟进有用关注 Swedish journalism
论文精选10:18AR1-ZO:拓扑感知的秩1零阶查询实现高秩LoRA微调解决了零阶优化与高秩LoRA结合时的信号坍缩问题,做大模型微调且受限于显存的开发者可以直接用AR1-ZO方法提升效果。#零阶优化#LoRA#大模型微调#拓扑感知aarXiv cs.AI@Ziye Chen 等 6 人原文稍后读已读值得跟进有用关注 零阶优化