论文10:16大模型通过持续预训练适应瑞典新闻业瑞典学者用新闻数据微调大模型,发现经验回放能防止遗忘,提升新闻写作质量。#Swedish journalism#continued pre-training#经验回放#大模型微调aarXiv cs.AI@Lukas Borggren 等 3 人原文稍后读已读值得跟进有用关注 Swedish journalism
论文11:42图像强化学习中整合新颖性与惊喜的经验回放方法DeepMind团队提出NSPER方法,结合新颖性和惊喜信号,让强化学习更高效探索。#Reinforcement Learning#NSPER#图像强化学习#经验回放aarXiv: Google DeepMind@Hoda Yamani 等 3 人原文稍后读已读值得跟进有用关注 Reinforcement Learning