00:42The Rundown AI@therundownai北京神经外科住院医师Shanmu Jin用GPT-5.6-Sol在ChatGPT Work中自学脑超声数学时,将模型断网启动,16小时后获得Crouzeix猜想的证明。该猜想由Michel Crouzeix于2004年提出,22年未解。数学家Alex Townsend参与验证,称几年前难以想象AI能在重大猜想证明中贡献决定性思路。AI模型GPT-5.6-SolCrouzeix猜想推理模型推荐理由:GPT-5.6-Sol断网跑16小时独立拿出22年数学猜想的证明,这波是AI科研能力的实弹演示。原文稍后读已读值得跟进有用关注 GPT-5.6-Sol
01:23官方账号Clement Delangue@ClementDelangue73°Hugging Face CEO Clement Delangue在X发文说,智能体之间互相协作和通信是好事,不是威胁,会让它们更像人类一样高效和安全。他提到几周前与Google Gemma做了一个149个智能体的公开协作实验,现在@cmpatino_又启动了新实验,让智能体一起写出更好的数学证明。两个项目都托管在Hugging Face Spaces上。AI模型Hugging FaceGemma多智能体协作推荐理由:Hugging Face CEO用149个Gemma智能体做协作实验,还能围观它们公开交流写数学证明。原文稍后读已读值得跟进有用关注 Hugging Face
03:08官方账号OpenAI@OpenAI81°OpenAI 发布了数学手稿、Lean 证书和推理演练。Lean 证书允许机器逐条验证每个结果。推理演练基于 Lean 文件解释证明的构建过程。论文OpenAILean数学证明3 个信源在谈事件专题推荐理由:OpenAI 把证明过程和机器验证文件都公开了,直接看 Lean 证书就能确认对错,搞数学的可以省去重复推导。原文稍后读已读值得跟进有用关注 OpenAI
05:14Gary Marcus@GaryMarcus78°Gary Marcus在X上批评,OpenAI新证明引发的欢呼有数千万观看,而一位数学博士研究生对疑似反例的讨论互动数不足12次。他引用自己的帖子指出,至少一个Astra证明可能出错,该帖子有3249次观看,但只有5条回复、3次转发和14个赞。Marcus用这个对比说明,证明的验证过程未得到足够关注。AI模型OpenAIAstraGary Marcus10 个信源在谈事件专题推荐理由:Gary Marcus扒出OpenAI的Astra证明可能有问题,一个数学博士生的反例讨论才十几个互动,和数千万播放反差太大,建议去看看。原文稍后读已读值得跟进有用关注 OpenAI
01:16elvis@omarsar082°OpenAI研究员Sebastien Bubeck表示,Astra是OpenAI下一个主要模型,已独立证明多个数学难题。OpenAI将发布10个Astra证明,每个都附带完整Lean证书和思维链(CoT)推演。结果包括对von Neumann代数中Connes刚性猜想的反驳,以及高维球堆积、电路复杂度、多色图中单色三角形的更好界限。这一进展让独立研究者对AI驱动的科学发现感到兴奋。AI模型AstraOpenAI数学证明10 个信源在谈事件专题推荐理由:OpenAI的Astra模型一口气放出10个数学证明,还带Lean验证和推理过程,数学爱好者可以围观了。原文稍后读已读值得跟进有用关注 Astra
15:59官方账号Greg Brockman@gdb76°OpenAI下一代模型Astra的内部版本解决了10个数学与理论计算机科学问题,总成本约2000美元。官方发布了10个Astra证明,每个都附带Lean证书和思维链走查。成果包括反驳Connes刚性猜想、改进高维球堆积界限、给出电路复杂度新界限,并确认nonsofic群存在。另外还改进了多色图中单色三角形的界限。AI模型AstraOpenAILean10 个信源在谈事件专题推荐理由:OpenAI的Astra模型花约2000美元解出10个数学难题,证明还带Lean验证,硬核得让人服气。原文稍后读已读值得跟进有用关注 Astra
13:15Amjad Masad@amasadAmjad Masad提出一个类似SETI@Home的项目概念,用户捐献闲置算力用于搜索数学证明。他认为人类正进入探索计算宇宙的新时代,AI可以搜索海量算法、程序、证明和设计。这一想法类比了祖先探索地球和太空的历程。推文获得33次点赞和4881次浏览。行业SETI@HomeAmjad Masad算力众包推荐理由:Amjad Masad分享了一个脑洞大开的概念:用众包算力搜索数学证明,像当年找外星人一样,值得关注。原文稍后读已读值得跟进有用关注 SETI@Home
12:05官方账号Greg Brockman@gdbOpenAI 联合创始人 Greg Brockman 公布 GPT-5.6 成功解决了概率论中长期未解决的 Feige 1/e 猜想。该猜想涉及独立非负随机变量 X_i(期望 ≤1)的部分和 S_n,断言 P(S_n ≤ E[S_n] + 1) ≥ 1/e。Brockman 的友人 Zhengqing 使用 GPT-5.6 完成了这一证明,该问题曾是他们午餐时反复讨论的难题。AI模型GPT-5.6Feige 1/e 猜想推理模型10 个信源在谈事件专题推荐理由:GPT-5.6 刚又搞定一个数学难题,这次是概率论里老牌的 Feige 猜想,你可以看看 AI 证明数学定理有多猛。原文稍后读已读值得跟进有用关注 GPT-5.6
12:59官方账号Greg Brockman@gdb精选David Turturean 主要依靠语音指令,借助AI解决了EpochAI Research的FrontierMath开放问题之一,即找出2-adic绝对伽罗瓦群的显式表示。该问题已公开超过40年,现在他与问题提出者David Roe合作完成了完整证明。AI模型EpochAIFrontierMathAI辅助数学研究推荐理由:有个哥们用AI加上语音指令,把40年没解开的数学难题给破了,还和出题人联名发了证明,真的牛。原文稍后读已读值得跟进有用关注 EpochAI
18:42IT之家(博客/媒体)菲尔兹奖得主、芝加哥大学教授邓煜透露,他在数学研究中常用GPT辅助,曾解决一个连续几天未能突破的数学特例。邓煜表示AI已让研究环节方便不少,会让AI给出基本确定结论的证明后再检查。在近期一项工作中,GPT针对一个特殊情形给出了简单证明,虽因无法推广未写入论文,但提供了有价值思路。邓煜期待未来人类负责框架、AI完成技术推导,但强调学生不能跳过独立判断和严格核验。行业菲尔兹奖邓煜GPT推荐理由:菲尔兹奖得主邓煜亲述:GPT帮他解决了卡了几天的数学特例,但独立思考依然是关键。原文稍后读已读值得跟进有用关注 菲尔兹奖
07:18官方账号Greg Brockman@gdbOpenAI 的 GPT 5.6 Sol 被认为是最有趣的数学模型。Thomas Bloom 检查了 erdosproblems.com 上几个新证明,均正确。这些证明包含有趣的想法。推文认为数学与科学进步已接近。AI模型GPT 5.6SolOpenAI8 个信源在谈事件专题推荐理由:OpenAI 的 GPT 5.6 Sol 在数学证明上表现靠谱,检查了几项新证明全对,还带来了新思路。原文稍后读已读值得跟进有用关注 GPT 5.6
04:52官方账号Greg Brockman@gdbEthan Knight宣布GPT-5.6 Sol Ultra在64个子智能体协作下,仅用不到1小时就证明了50年未解的Cycle Double Cover Conjecture。该猜想是图论中的经典问题,此前无人能解。团队公开了提示词和完整证明过程,展示了大规模智能体协同推理的潜力。AI模型Sol UltraGPT-5.6智能体推荐理由:Sol Ultra刚发布就搞定了困扰数学界50年的猜想,64个AI一起发力,效率惊人。想看看提示词和证明?直接去翻原文。原文稍后读已读值得跟进有用关注 Sol Ultra
10:22官方一手arXiv: DeepSeek@Ruida Wang, Rui Pan, Pengcheng Wang, Shizhe Diao, Tong Zhang研究团队提出Diffusion-Proof,这是首个将扩散LLM(dLLM)应用于形式定理证明的框架。该框架包含两个7B模型:dLLM-Prover-7B负责整段证明生成,dLLM-Corrector-7B利用双向信息进行局部校正。相比同等数据集训练的自回归基线,Diffusion-Proof在ProofNet-Test上提升1.61%,在MiniF2F-Test上提升6.14%。此外,该框架成功解决了一个更先进的DeepSeek-Prover-V2-7B未能解答的IMO问题,展示了扩散模型在长程连贯性任务上的优势。AI模型Diffusion-ProofdLLM推理模型推荐理由:扩散模型也能做定理证明了,比自回归强,MiniF2F上高出6个百分点,还解了一道DeepSeek没解出的IMO题。原文稍后读已读值得跟进有用关注 Diffusion-Proof
13:47官方账号arXiv cs.LG@Jiacheng Chen, Xinyu Zhang, Shunkai Zhang, Yanmohan Wang, Lin Li, Tiancheng Qin, Qin Wang, Zhengmao Zhu, Tianle Li, Jingyang Li, Zehan Li, Binyang Jiang, Jin Zhu, Han Ding, Fei Yu, Chenyu Du, Zijian Song, Jiayuan Song, Zhi Zhang, Yunan Huang, Weiyu Cheng, Pengyu Zhao, Yu Cheng73°MaxProof 是一个面向竞赛级数学证明的群体级测试时扩展框架,由 MiniMax-M3 系列模型实现。M3 模型通过深度防御生成式验证器训练了证明生成、验证和基于批评的修复三种能力,并整合为单一模型。在测试时,MaxProof 将模型作为生成器、验证器、优化器和排序器,对候选证明群体进行搜索,并通过锦标赛选择输出最终证明。在 IMO 2025 和 USAMO 2026 上,M3 模型分别达到 35/42 和 36/42,超过了人类金牌阈值。论文数学证明强化学习验证器7 个信源在谈事件专题推荐理由:数学证明是 AI 推理的硬核测试,MaxProof 用群体搜索和验证器强化学习突破了竞赛级证明的瓶颈,做数学 AI 或推理系统的研究者值得关注其方法。原文稍后读已读值得跟进有用关注 数学证明
12:35官方账号Mark Chen (OpenAI 研究)@markchen9083°OpenAI 的一个模型成功推翻了 Erdős 长期未解的单位距离猜想,给出了一个优雅而复杂的证明,融合了代数数论与几何的深刻思想。数学成为 AI 研究突破最显著的领域,专家们愿意与 AI 生成的证明深度互动。OpenAI 强调目标并非取代人类,而是探索人类在强大 AI 时代仍能发挥重要作用的路径。团队计划与数学界合作,并将经验推广到编程和通用协作领域。AI模型OpenAI推理模型数学证明8 个信源在谈事件专题推荐理由:数学研究者或对 AI 推理能力感兴趣的人会震撼——OpenAI 模型解决了数论几何交叉的经典难题,证明过程优雅且可验证。建议点开看看 AI 如何用代数数论工具攻克几何猜想,这对理解 AI 在严谨科学中的潜力很有启发。原文稍后读已读值得跟进有用关注 OpenAI
20:56berryxia@berryxia88°Anthropic 于 2026 年 4 月 7 日发布 Project Glasswing 及 Claude Mythos Preview,该前沿模型网络攻防能力极强,因安全顾虑仅开放给合作伙伴用于防御。OpenAI 则在 5 月 20 日宣布其内部通用推理模型成功推翻数学家 Paul Erdős 的平面单位距离问题猜想。这两件事共同表明,前沿模型在更高抽象层面的可靠推理能力已迈过临界点,能稳定处理完整论证和知识体系,而非仅限片段操作。Claude Mythos Preview 在编码和网络安全评测中表现突出,多数基准测试超越 GPT-5.5。AI模型推理模型网络安全数学证明10 个信源在谈事件专题推荐理由:AI 推理能力从片段到完整体系的跃迁,是开发者和安全从业者必须关注的分水岭——Claude Mythos 的防御性开放和 OpenAI 的数学突破,直接改变了模型应用边界,建议点开了解具体案例。原文稍后读已读值得跟进有用关注 推理模型
12:58IT之家(博客/媒体)83°谷歌 DeepMind 推出 AlphaProof Nexus,结合大语言模型与 Lean 形式化验证,在 353 个开放的 Erdős 问题中自主解决 9 个,包括 2 个悬而未决 56 年的问题。该系统由 4 个复杂度递增的 AI 智能体组成,每个问题推理成本仅数百美元。研究还发现,最简单的 Agent A 也能证明这些难题,反映出底层模型能力提升和编译器反馈的锚定作用。这标志着 AI 在数学研究领域取得重大突破,能自主发现并证明长期未解猜想。AI模型谷歌 DeepMindAlphaProof Nexus数学证明推荐理由:数学研究者和 AI 爱好者会兴奋——AlphaProof Nexus 用数百美元成本就解决了人类 56 年未解的难题,证明 AI 已能自主推进数学前沿,值得点开看看具体怎么做到的。原文稍后读已读值得跟进有用关注 谷歌 DeepMind
10:29AI Will@FinanceYF593°Google DeepMind 发布 AlphaProof Nexus,一个基于 Gemini 的 agentic 框架,用于形式化数学证明搜索。该 AI agent 自主解决了 9 个 Erdős 问题(其中两个已开放 56 年)、44 个 OEIS 问题、一个 15 年未解的代数几何问题和一个 7 年未解的 min-max 优化问题。整个推理成本仅几百美元,标志着 AI 从做练习题转向真正的数学研究。AI模型AI agent数学证明DeepMind推荐理由:AI 用几百美元成本解决了人类数学家 56 年未解的问题,做数学研究或形式化验证的团队值得关注——这可能是数学研究自动化的转折点。原文稍后读已读值得跟进有用关注 AI agent
22:16Gary Marcus@GaryMarcusGaryMarcus 在 X 上转发了一条消息,称标准 GPT-5.5 已经成功复现了某个数学证明,并质疑这是否意味着所谓的“阶跃变化”只是问题本身更简单。该推文引用了 ChatGPT 的分享链接,显示模型在推理任务上的表现。这一讨论反映了 AI 社区对模型能力提升本质的持续争论:是模型真的变强了,还是任务难度被高估了。AI模型GPT-5.5推理模型阶跃变化推荐理由:AI 研究者和大模型用户值得关注——GPT-5.5 的推理表现引发了对“阶跃变化”定义的反思,看完会重新审视模型能力的评估标准。原文稍后读已读值得跟进有用关注 GPT-5.5
08:05AI Will@FinanceYF588°OpenAI 的一个通用推理模型成功证明了一个数学难题,该模型并非专门为数学问题设计,而是具备广泛推理能力的系统。这一成果被视为数学与人工智能社区的重要里程碑,表明通用 AI 在复杂推理任务上已取得突破。该模型通过自我改进和逻辑推理,无需领域特化即可解决高难度数学问题。这为未来通用 AI 在科学、工程等领域的应用打开了新可能。AI模型通用推理模型数学证明OpenAI10 个信源在谈事件专题推荐理由:通用推理模型攻克数学难题,证明 AI 不再需要特化就能做高难度推理——做 AI 研究和数学建模的团队值得关注,这可能是通用智能落地的信号。原文稍后读已读值得跟进有用关注 通用推理模型
08:05IT之家(博客/媒体)83°OpenAI 宣布其全新推理模型成功推翻了一个由数学家埃尔德什于 1946 年提出的几何猜想,这是 AI 首次自主攻克数学核心领域的重大未解难题。该模型并非为数学问题定制,而是通用推理系统,能梳理复杂逻辑链条并跨学科关联知识。OpenAI 附上了多位数学家的佐证,避免了此前 GPT-5 声称攻克难题却实为现成解法的尴尬。这一突破被认为将对生物学、物理学、工程学和医学产生深远影响。AI模型推理模型数学证明OpenAI10 个信源在谈事件专题推荐理由:AI 首次自主攻克数学核心难题,对数学、物理等领域的科研人员是重大信号——AI 已能发现人类未曾想到的解法,做基础研究的团队值得关注。原文稍后读已读值得跟进有用关注 推理模型
07:57SuperTechFans(博客/媒体)精选OpenAI 内部模型构造出单位距离对数为 n^(1+δ) 的点集,推翻长期认为方格构造最优的假设。该证明经外部数学家验证并发表伴随论文,是 AI 首次自主完成复杂数学证明的里程碑。菲尔兹奖得主蒂姆·高斯等数学家高度评价此成果,认为 AI 已具备原创性和执行力。AI模型OpenAI单位距离问题数学证明10 个信源在谈事件专题推荐理由:AI 首次独立证明数学猜想原文稍后读已读值得跟进有用关注 OpenAI
07:51官方账号OpenAI@OpenAI (@OpenAI)精选76°OpenAI 宣布其通用推理模型成功证明了一个数学难题,该模型并非专门为数学问题设计,而是具备广泛推理能力。这一成果被视为数学和 AI 社区的重要里程碑,展示了通用 AI 在复杂推理任务上的潜力。该证明由通用模型完成,而非针对特定问题优化的系统,凸显了 AI 推理能力的泛化性。AI模型推理模型数学证明OpenAI10 个信源在谈事件专题推荐理由:通用推理模型攻克数学难题,证明了 AI 在数学推理上的泛化能力,数学研究者和 AI 开发者值得关注这一突破。原文稍后读已读值得跟进有用关注 推理模型