12:59官方账号Greg Brockman@gdb精选David Turturean 主要依靠语音指令,借助AI解决了EpochAI Research的FrontierMath开放问题之一,即找出2-adic绝对伽罗瓦群的显式表示。该问题已公开超过40年,现在他与问题提出者David Roe合作完成了完整证明。AI模型EpochAIFrontierMathAI辅助数学研究推荐理由:有个哥们用AI加上语音指令,把40年没解开的数学难题给破了,还和出题人联名发了证明,真的牛。原文稍后读已读值得跟进有用关注 EpochAI
01:40官方账号Epoch AI@EpochAIResearchEpoch AI Research 推出 EpochAIPlays 项目,首场直播将基准测试 GPT 5.6 Sol 在游戏 Slay the Spire 上的能力。直播由 @AlephNuul 提供实时评论。该基准测试旨在评估模型在策略游戏中的推理和决策水平。结果将反映 GPT 5.6 Sol 在复杂规则环境下的表现。AI模型EpochAIGPT-5.6 SolSlay the Spire推荐理由:看看 Epoch AI 怎么用 Slay the Spire 测试 GPT-5.6 Sol 的游戏智商,和之前的基准很不一样。原文稍后读已读值得跟进有用关注 EpochAI
17:39官方账号Epoch AI@EpochAIResearchEpochAI Research 宣布新项目 EpochAIPlays,其最新模型 GPT-5.6 Sol 将直播玩卡牌游戏《Slay the Spire》。直播将于周四启动,由 @AlephNuul 提供实时解说。该项目旨在公开演示 AI 在复杂策略游戏中的决策能力。AI模型GPT-5.6 SolEpochAIEpochAIPlays推荐理由:EpochAI 让 GPT-5.6 Sol 直播打《Slay the Spire》,周四有解说,看看 AI 怎么玩策略游戏,挺新鲜的。原文稍后读已读值得跟进有用关注 GPT-5.6 Sol
14:55官方账号Epoch AI@EpochAIResearchEpochAI Research在本周通讯中由@datagenproc、@joemkwon和@ansonwhho提出一种更精细的工具:包含60多项任务的前沿AI研究分类法,用于衡量AI自动化AI研发的进展。当前经济学家使用的自动化工具过于粗糙,无法准确评估。该分类法覆盖了从实验设计到论文撰写等完整研发流程。行业EpochAIAI自动化前沿AI研究推荐理由:EpochAI做了个60多项任务的分类,能更准地衡量AI自己搞研发的进展,比现有工具细多了。原文稍后读已读值得跟进有用关注 EpochAI
11:51官方账号Epoch AI@EpochAIResearchEpochAI Research 推出了一个网络漏洞探索器,可视化自2022年以来向CVE项目报告的常见漏洞和暴露(CVE)。该工具旨在验证AI公司声称其模型在发现软件漏洞方面越来越好的说法是否属实。通过公开数据,用户可以直观地看到漏洞报告的趋势和分布。这为评估AI在网络安全领域的实际进展提供了数据支持。AI产品漏洞检测CVE网络安全推荐理由:做安全研究和漏洞分析的团队,终于有了一个公开数据工具来验证AI模型的真实能力,建议点开看看趋势图。原文稍后读已读值得跟进有用关注 漏洞检测