17:48Marc Andreessen@pmarca精选Edgar Dobriban利用GPT-5.6 Sol Pro在90分钟推理内,证明Benjamini-Hochberg(BH)过程在相关高斯双尾检验中无法普遍控制错误发现率(FDR)。通过一个高斯因子模型,在名义水平alpha=0.01时,实际FDR被证明超过0.0104。该问题自Benjamini和Hochberg(1995)提出以来已悬而未决近30年,论文引用超13万次。GPT-5.5在约20小时多智能体迭代中未能解决此问题。论文GPT-5.6 Sol ProBenjamini-Hochbergfalse discovery rate1 个信源在谈事件专题推荐理由:AI真的在推动数学进步了:GPT-5.6只用90分钟就找到了统计学里一个经典开放问题的反例,而5.5版本折腾20小时都没搞定。这篇报告值得所有关心AI科研能力的人看。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol Pro
14:04官方账号Greg Brockman@gdb73°Edgar Dobriban利用GPT-5.6 Sol Pro解决了统计学中一个开放问题:Benjamini-Hochberg(BH)程序在相关高斯数据下无法控制错误发现率(FDR)。该程序由Benjamini和Hochberg于1995年提出,被引用超13万次,但FDR控制仅对独立数据成立。尽管有多个猜想认为其对相关数据也有效,GPT-5.6 Sol Pro通过一个高斯因子模型(名义水平α=0.01,实际FDR>0.0104)证明了该猜想错误。模型经过90分钟推理一次性解决,而GPT-5.5在20小时内未能完成。论文GPT-5.6 Sol ProEdgar DobribanBenjamini-Hochberg1 个信源在谈事件专题推荐理由:AI帮你揭开了统计学25年的难题:GPT-5.6 Sol Pro用90分钟证明BH方法在相关数据下会失效,比人类20小时还准。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol Pro
01:54官方账号Decoder@Matthias Bastian88°宾夕法尼亚大学统计学教授使用OpenAI的GPT-5.6 Sol Pro在90分钟内证伪了关于Benjamini-Hochberg方法的一个核心开放猜想,该猜想已悬而未决30年。作为对比,前代模型GPT-5.5连续运行20小时仍无法找到解。模型通过现有方法的新颖组合达成结果,引发AI能否产生真正新知识的讨论。AI模型GPT-5.6 SolOpenAIBenjamini-Hochberg10 个信源在谈事件专题推荐理由:OpenAI的GPT-5.6 Sol居然90分钟就搞定了人类30年没破解的统计难题,前代模型20小时都搞不定,这进步太猛了。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol