#强化学习

共 614 条 · 7 天 61 条 · 30 天 198 条 · 话题观测 →
6月9日
产品中美对照多源确认精选76°00:54
OpenEnv 由 Meta-PyTorch、NVIDIA 等委员会接管,开源智能体 RL 协议层

OpenEnv 解决了开源智能体 RL 中模型与训练框架耦合的痛点,做智能体训练或强化学习的开发者可以直接用它作为协议层来自由组合工具,值得关注并尝试。

事件专题
Thomas Wolf@Thom_Wolf9 个信源在谈原文
6月7日
6月6日
6月5日
6月4日
6月3日
6月2日
论文精选12:19
LP-DS:轻量级扩散策略微调方法,提升机器人操控与强化学习效率

做机器人操控或强化学习的团队,终于有了一个不更新大模型也能微调扩散策略的轻量方案——LP-DS 在保持动作多样性的同时提升回报,建议试试看能否解决你的分布偏移问题。

事件专题
arXiv: OpenAI@Hikmet Simsir, Ozgur S. Oguz2 个信源在谈原文
论文多源确认12:06
ReSkill:在智能体强化学习中协调技能创建与策略优化

做智能体强化学习的团队终于有了一个能自动积累可复用策略的框架——ReSkill 让技能创建和策略优化不再打架,直接提升泛化能力,做 RL 和 LLM 智能体的研究者值得细读。

事件专题
arXiv: Anthropic@Zelin He 等 9 人5 个信源在谈原文
6月1日
5月31日
5月30日
5月29日
5月28日