论文多源确认11:13Fisher-R1:训练LLM代理实现可靠假设检验开源模型Fisher-R1专治假设检验,比GPT-5.4和DeepSeek-V4-Pro都强,最难任务能提26%,搞数据分析的可以看看。#Fisher-R1#P-Bench#假设检验#智能体3 个信源在谈事件专题aarXiv cs.AI@Jiacheng Miao 等 4 人4 个信源在谈原文稍后读已读值得跟进有用关注 Fisher-R1