8月21日
13:18
09:43
8月20日
10:15
10:15官方账号arXiv cs.AI@Ruiguo Zhong, Benshan Ma, Xiaolong Chen, Lang Zhang, Mingyue Feng, Yaonong Wang, Pei Liu, Jun Ma
精选
DA-WAM是一种针对自动驾驶场景的决策优化框架,通过统一预测与动作条件未来建模来提升决策质量;该框架在NAVSIM-v1和NAVSIM-v2基准上实现领先表现,用行动条件预测生成不同轨迹的未来潜在状态;未来潜在条件化因子化评分器评估各候选轨迹,保障安全边界下的规划效果。
推荐理由:DA-WAM是专门给自动驾驶做决策优化的框架,用它模拟未来场景选路径,比以前方法在NAVSIM那些测试里效果好,你感兴趣可以去了解下。
8月14日
18:49
8月10日
00:30
8月5日
01:38
01:38techcrunch@Kirsten Korosec
71°
Waymo在达拉斯正式取消Robotaxi服务的候补名单,向所有用户开放。所有达拉斯用户现在都可以直接使用该服务,无需等待。这是Waymo在美国、英国和欧洲扩大自动驾驶技术部署的最新一步。
事件专题

推荐理由:Waymo的无人出租车在达拉斯终于不用排队等名额了,现在谁都能直接叫。想体验自动驾驶的可以试试。
8月4日
09:36
09:36官方账号arXiv cs.AI@Zhihao Zhu, Hanlin Shang, Mingwang Xu, Feipeng Cai, Zhuolin He, Yaoyi Li, Jianhua Han, Hang Xu, Siyu Zhu
WAM-Diff2是一种多任务离散扩散VLA框架,通过三阶段分层蒸馏将预训练自回归模型转化为并行扩散模型。该方法解决了自回归解码的高延迟和暴露偏差问题,同时保留多任务视觉-语言推理能力。在驾驶理解、感知和规划基准上,WAM-Diff2与自回归基线性能持平。推理加速达2.8倍,结合FlashInfer和CUDA Graphs系统优化后最高可达15.1倍。
推荐理由:它把慢吞吞的自回归VLA模型变成并行扩散模型,性能不掉,推理快2.8倍,还能跑自动驾驶多任务。
08:40
7月30日
7月29日
19:20
19:20官方一手pandaily@contact@pandaily.com (Pandaily)
比亚迪AI团队首次公开HyWorldVLA混合世界模型,采用像素-潜在混合世界建模与VLA架构,在NAVSIM v1基准上取得90.59 PDMS,达到SOTA。该模型由比亚迪与哈尔滨工业大学机器人研究人员合作开发。这一成绩标志着比亚迪正式进入自动驾驶基础模型赛道。

推荐理由:比亚迪悄悄拿出的HyWorldVLA,在NAVSIM上直接以90.59分拿下SOTA,这是他们首次秀自动驾驶基础模型肌肉。
11:55
11:55官方账号arXiv cs.AI@Yuan Yin, Elias Ramzi, Marc Lafon, Valentin Charraut, Victor Bares, Yihong Xu, Éloi Zablocki, Alexandre Boulch, Thibault Buhet, Andrei Bursuc, Matthieu Cord
73°
Pictura是一个GPU加速的多智能体驾驶模拟器,在单张H100上每秒可处理50万智能体步(200万张图像)。它直接渲染每个智能体的第一人称视角,消除了传统特权观测带来的表征鸿沟。基于Pictura,研究者用纯PPO训练了Alberti策略,历经500亿智能体步(约3500万公里驾驶)。该策略首次实现直接从透视图像进行大规模自对弈学习,性能接近特权向量化基线,并在Waymo Open Motion Dataset渲染场景中零样本超越特权智能体。
事件专题

推荐理由:Pictura让自动驾驶策略直接从相机图像自对弈学,跑完3500万公里,性能逼近用真实位置速度的版本,值得AI研究员看看。
7月27日