18:48官方账号Decoder@Jonathan Kemper77°Google Deepmind 提出 GenCeption 方法,利用视频生成器完成深度估计和语义分割等经典视觉任务。该方法在仅使用合成视频训练的情况下,匹配甚至超越当前最先进系统的性能。研究团队认为视频生成器内部已经隐式包含了一种通用世界模型,这挑战了传统计算机视觉的范式。GenCeption 在 KITTI 深度估计基准上取得了与基于真实数据训练的模型相当的结果,证明了其有效性。论文GenCeptionGoogle Deepmind视频生成推荐理由:Deepmind 把视频生成器当成通用感知模型,用合成视频训练就达到了顶级深度估计水平,挺震撼的,值得一看。原文稍后读已读值得跟进有用关注 GenCeption