#世界模型
Code World Model结合了语言模型和视频模型,通过编码代理实现世界大脑,为开放式世界模型提供新路径,值得了解。
凯迪拉克把 Momenta R7 世界模型装进 XT5 PHEV,8月21日成都车展预售,能处理滚落苹果、开门杀这种突发状况,还带城区 NOA。
Gary Marcus 说 ARC-AGI-3 上跑得最好的都用了神经符号世界模型,想看这方向为什么牛,可以读这条。
接触密集操作总在碰坏了才发现问题?ContactGuard 在接触前看潜在视觉嵌入提前判断,能直接发中止信号,不用改策略。
Dyna Robotics把100万小时人类视频喂给机器人模型,搞出了Dyna-2,还验证了缩放定律能跨界到机器人数据,看它怎么做到跨实体泛化挺有意思。
凯迪拉克把Momenta R7世界模型塞进XT5 PHEV,不用等OTA就能用,带激光雷达和蜂鸟底盘,能应对开门杀和滚落苹果,想买豪华混动SUV的可以看看。
Dyna Robotics出了个新模型Dyna-2,用100万小时人类视频训练,相当于170年经验,机器人学习的新路子,值得看看。
三星这次是动真格了,除了子公司Rainbow,自己也在搞人形机器人,还挖了波士顿动力背景的人来带队,想看看它能不能靠家电底子做出差异化。
Dyna Robotics放出了个叫Dyna-2的世界动作模型,用100万小时人类视频训的,能预测未来再行动,还发现了数据量越大越强的缩放规律,值得看看。
这篇论文把世界模型的训练目标改成直接预测终点,DPWM在长时程预测上比递归模型准很多,而且越长优势越明显。想搞长时程决策的可以看看。
EgoGenesis是个能生成机器人操作视频的工具,用400条合成数据就把单臂成功率从77%提到84%,双臂从53%提到70%,挺厉害。
DeepMind 的 Tom Zahavy 说了个大实话:LLM 搞不了真正的新发现,得靠世界模型。不是泛泛空谈,有论文为证。
NVIDIA在SIGGRAPH上发布了Cosmos-Dreams,一个能主动计算生成训练数据的模拟器。物理AI开发不再只靠收集数据了,看看演示视频吧。