论文12:10PACT:小型语言模型规划提升反应式强化学习在陌生环境中的表现这篇论文提出了PACT,用一个小型语言模型来规划动作,再结合强化学习策略,在FrozenLake上比纯RL效果好,而且不用重训练。#PACT#Small Language Model#Reinforcement Learning#FrozenLakeaarXiv cs.LG@Nathan Gavenski 等 5 人原文稍后读已读值得跟进有用关注 PACT