全部动态

AI 相关资讯全量信息流 · 6327 条
9月14日
研究提出新方法提升强化学习策略对抗输入扰动的鲁棒性

这是篇关于如何提升强化学习模型鲁棒性的研究论文,作者开源了实现代码,对做相关研究的人可能有参考价值。

arXiv cs.LG@Amine Andam 等 3 人原文
Nvidia Hopper GPU 大模型推理时 GPU 利用率分析研究

这个研究很实用,帮你理解为什么你的大模型推理时 GPU 利用率看起来很高,但实际计算效率可能很低。作者用具体的技术(vLLM、FlashAttention-3)和硬件(H100)做了实验,结论很扎实。

事件专题
arXiv cs.LG@Mohammad Siavashi 等 4 人2 个信源在谈原文
自适应舒适边界动作空间提升自动驾驶政策性能

这个研究解决了自动驾驶中一个很实际的问题,就是让AI驾驶更符合人类舒适感。他们开发了一个方法,让AI在控制车辆时更平滑,不会突然加速或转向,比之前的方法更好。

事件专题
arXiv cs.AI@Anna Rothenhäusler 等 7 人2 个信源在谈原文
宾夕法尼亚大学「World Models」课程讲义公开

朋友,宾夕法尼亚大学新开了一门「World Models」课,讲义公开了。这门课讲的是让AI模型学会预测世界变化,不是单纯靠文本训练。内容挺硬核,有基础理论、生成模型,还有视频、机器人这些应用,适合想深入了解世界模型的同学。

shao__meng@shao__meng原文
一种新的循环Transformer架构技术报告发布

朋友,这是Yifan Zhang团队提出的一个新架构,叫Recurrent Looped Transformer (RLT),它通过让解码器循环处理每个token来提升效率,和传统模型比,在保持每个token计算成本不变的情况下,深度可以随序列增长,挺有意思的。

elvis@omarsar0原文
9月13日

仅展示最近 2000 条内容,更早的内容请查阅 AI 日报存档