全部 AI 动态 · AI 热点

6月16日

20:46

AITOP6月16日 20:46

600亿美元买下Cursor，xAI终于拿到了编程工具，但真正值得跟踪的或许不是AI

600亿美元买下Cursor，xAI终于拿到了编程工具，但真正值得跟踪的或许不是AI

6月12日

12:57

AITOP6月12日 12:57

Claude代码里藏了个20260612，18个月后的AI记忆革命已经开始倒计时

6月11日

15:28

AITOP6月11日 15:28

1107 vs 303：谷歌悄悄开源了一个“拆打字机”的模型，把大模型速度翻了4倍

15:23

AITOP6月11日 15:23

DiffusionGemma颠覆文本生成？自回归模型的“统治”要结束了

15:07

AITOP6月11日 15:07

每秒1107个token，Google开源的扩散模型为什么能改变本地推理格局？

5月22日

11:14

11:14

arXiv cs.AI@Ismail Geles, Leonard Bauersfeld, Markus Wulfmeier, Davide Scaramuzza

76°

苏黎世大学团队通过多智能体强化学习（MARL）训练高速四旋翼无人机竞速，在超过22米/秒的速度下，不仅击败了人类冠军飞行员，还将碰撞率比最先进的单智能体基线降低了50%。该研究以联赛式自对弈训练智能体学会主动避让、超车和处理复杂气动干扰，并实现了对人类的零样本安全泛化。结果表明，多智能体交互的严苛训练比孤立的安全约束更能实现鲁棒的机器人共存。

论文多智能体强化学习无人机竞速安全交互零样本泛化苏黎世大学

推荐理由：这项研究证明了多智能体强化学习在物理世界交互中的安全优势，做无人机、自动驾驶或机器人协作的团队值得关注——它用竞速场景给出了一个可复现的范式。