17:48Marc Andreessen@pmarca精选Edgar Dobriban利用GPT-5.6 Sol Pro在90分钟推理内,证明Benjamini-Hochberg(BH)过程在相关高斯双尾检验中无法普遍控制错误发现率(FDR)。通过一个高斯因子模型,在名义水平alpha=0.01时,实际FDR被证明超过0.0104。该问题自Benjamini和Hochberg(1995)提出以来已悬而未决近30年,论文引用超13万次。GPT-5.5在约20小时多智能体迭代中未能解决此问题。论文GPT-5.6 Sol ProBenjamini-Hochbergfalse discovery rate1 个信源在谈事件专题推荐理由:AI真的在推动数学进步了:GPT-5.6只用90分钟就找到了统计学里一个经典开放问题的反例,而5.5版本折腾20小时都没搞定。这篇报告值得所有关心AI科研能力的人看。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol Pro
14:04官方账号Greg Brockman@gdb73°Edgar Dobriban利用GPT-5.6 Sol Pro解决了统计学中一个开放问题:Benjamini-Hochberg(BH)程序在相关高斯数据下无法控制错误发现率(FDR)。该程序由Benjamini和Hochberg于1995年提出,被引用超13万次,但FDR控制仅对独立数据成立。尽管有多个猜想认为其对相关数据也有效,GPT-5.6 Sol Pro通过一个高斯因子模型(名义水平α=0.01,实际FDR>0.0104)证明了该猜想错误。模型经过90分钟推理一次性解决,而GPT-5.5在20小时内未能完成。论文GPT-5.6 Sol ProEdgar DobribanBenjamini-Hochberg1 个信源在谈事件专题推荐理由:AI帮你揭开了统计学25年的难题:GPT-5.6 Sol Pro用90分钟证明BH方法在相关数据下会失效,比人类20小时还准。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol Pro