23:00elvis@omarsar0推文指出大多数视频动作机器人模型是将视频生成器拼接动作头,而LingBot-VA 2.0从头预训练整个控制堆栈。该模型在技术上有多项改进,与传统方法相比在控制任务上表现更优。推文提及LingBot-VA 2.0的预训练策略使其在机器人动作预测中脱颖而出。AI模型LingBot-VA 2.0机器人视频动作模型推荐理由:如果你想了解机器人视频动作模型的新路子,LingBot-VA 2.0直接从头训练控制栈,不搞拼接,挺有看头。原文稍后读已读值得跟进有用关注 LingBot-VA 2.0
16:07官方一手marktechpost@Asif Razzaq蚂蚁集团旗下Robant发布LingBot-VA 2.0技术报告,这是为具身智能原生构建的视频动作基础模型,而非从视频生成器微调。模型通过Foresight Reasoning预测未来状态,并基于每个真实观测重新接底,实现225Hz异步控制。架构采用因果DiT、稀疏MoE视频流和语义视觉动作分词器。AI模型LingBot-VA 2.0Robant具身智能推荐理由:蚂蚁Robant出了个面向具身AI的模型LingBot-VA 2.0,能预测未来状态并以225Hz实时控制,跟那些从视频生成器改的模型思路完全不一样。原文稍后读已读值得跟进有用关注 LingBot-VA 2.0