11:41官方账号arXiv cs.LG@Zhibin Kang, Hanmo You, Dong Wang, Haiming Zheng, Junjie Chen这篇论文对强化学习智能体的模糊测试方法进行了首次全面实证研究,从有效性、多样性、效率和实用性四个维度评估了五种最先进方法(MDPFuzz、SeqDivFuzz等)和随机测试。实验在MountainCar、BipedalWalker和CARLA三个复杂度递增的环境中进行统一配置。结果显示,MDPFuzz等吞吐量导向方法在发现崩溃方面更有效,而SeqDivFuzz等鼓励探索的方法更擅长发现多样化的崩溃行为。模糊测试产生的崩溃可有意义地提升智能体鲁棒性,并支持准确的跨方法泛化安全监控。论文强化学习模糊测试MDPFuzz推荐理由:这篇论文系统对比了RL模糊测试方法,告诉你MDPFuzz找崩溃快、SeqDivFuzz找花样多,还测了在CARLA等环境下的实际效果,做RL安全测试的别错过。原文稍后读已读值得跟进有用关注 强化学习