11:55官方账号arXiv cs.AI@Yuan Yin, Elias Ramzi, Marc Lafon, Valentin Charraut, Victor Bares, Yihong Xu, Éloi Zablocki, Alexandre Boulch, Thibault Buhet, Andrei Bursuc, Matthieu Cord73°Pictura是一个GPU加速的多智能体驾驶模拟器,在单张H100上每秒可处理50万智能体步(200万张图像)。它直接渲染每个智能体的第一人称视角,消除了传统特权观测带来的表征鸿沟。基于Pictura,研究者用纯PPO训练了Alberti策略,历经500亿智能体步(约3500万公里驾驶)。该策略首次实现直接从透视图像进行大规模自对弈学习,性能接近特权向量化基线,并在Waymo Open Motion Dataset渲染场景中零样本超越特权智能体。AI模型PicturaAlberti驾驶模拟器2 个信源在谈事件专题推荐理由:Pictura让自动驾驶策略直接从相机图像自对弈学,跑完3500万公里,性能逼近用真实位置速度的版本,值得AI研究员看看。原文稍后读已读值得跟进有用关注 Pictura