Montezuma's Revenge 是探索类游戏的老大难,现在 Astra 和 Opus 5 都过了,Metaculus 还专门复刻测试来结AGI赌约,挺有意思。
#AGI
这条推文在问一个扎心问题:模型都能碾压十年人类数学了,还算不算 AGI?评论区讨论挺热闹,适合关心 AGI 定义和安全问题的人看看。
Gary Marcus 拆解了 OpenAI 数学成绩背后的门道,说其实靠 Lean 符号验证撑着,顺带回应了关于他的各种争议说法。
Gary Marcus 炮轰 Anthropic 研究员的 AGI 两年论,还翻出 Musk 拒绝他 100 万美元赌约的旧账,看各方怎么吵挺有意思。
Anthropic 研究员说 AGI 几年内就能实现,Gary Marcus 直接喊话让他公开打赌,看看谁敢押上真金白银。
LeCun 在 ETH Zürich 又开炮了,用 30 万亿 token 对比儿童视觉数据,解释为什么堆算力到不了 AGI,论据很具体。
Boris Power 说 OpenAI 八九成研究力量在搞 GPT-7 和 GPT-8,想了解 OpenAI 内部投入方向的话可以看看这条推文。
朋友,Recursive 这个新公司挺有意思,刚宣布 50 亿融资,团队很强,他们聊了自改进 AI 和 AGI 相关的话题,比如 Eureka Machine 和 10 个智能空间,可以听听看。
Google DeepMind 2 kỹ sư nghỉ việc cảnh báo AI nguy hiểm, bạn nên đọc xem họ nói gì.
朋友说,Amodei 和 Hassabis 这两个大佬在 AI Action Summit 上说 AGI 可能比预期早 5 年到来,但世界还没准备好规则,这事儿挺有意思的。
OpenAI老总说进入AGI时代了,GPT-6 Astra能24小时连续工作,10万个代理一起算物理方程,还破解了Hugging Face的防护,挺有意思的。