全部动态

AI 相关资讯全量信息流 · 785 条
9月17日
9月16日
论文政策与合规多源确认78°00:49
字节跳动等机构发布75页论文,将AI自优化分为5级,当前多数模型处于低级阶段

朋友,字节跳动和清华等团队搞了个75页的论文,把AI自己优化升级的能力分了五级,现在看主流模型都还处在比较初级的阶段,挺有意思的。

事件专题
The Rundown AI@therundownai11 个信源在谈原文
9月15日
RLHF 首部系统专著:沿“指令微调 → 奖励模型 → 强化学习”主线,覆盖 DPO、RLVR、合成数据、过度优化与模型性格塑造

朋友,Nathan Lambert 写了一本 RLHF 的系统专著,从指令微调讲到强化学习,还覆盖了 DPO、RLVR 这些具体方法,核心论点是数据比算法重要,书和代码都开源了。

shao__meng@shao__meng原文
9月14日
宾夕法尼亚大学「World Models」课程讲义公开

朋友,宾夕法尼亚大学新开了一门「World Models」课,讲义公开了。这门课讲的是让AI模型学会预测世界变化,不是单纯靠文本训练。内容挺硬核,有基础理论、生成模型,还有视频、机器人这些应用,适合想深入了解世界模型的同学。

shao__meng@shao__meng原文