论文09:25PWO:神经量子态的临近波函数优化算法这篇把强化学习的信任域优化用在神经量子态上,新算法PWO比Adam稳,还能用1.5B的RWKV-7跑,规模大了三个数量级。#PWO#RWKV-7#神经量子态#强化学习aarXiv cs.LG@Juan Agustín Duque 等 7 人原文稍后读已读值得跟进有用关注 PWO