论文09:42MDP中灾难态导致前景理论行为:Bellman最优性产生S型价值函数这篇论文揭示了灾难态本身就能产生前景理论行为,对做强化学习安全控制、风险决策建模的研究者很有启发,建议读一下推导和实验设计。#强化学习#前景理论#灾难态#风险决策aarXiv cs.AI@Yujiao Chen原文稍后读已读值得跟进有用关注 强化学习