#具身智能
小米开源了一个叫 Xiaomi-Robotics-U0 的模型,能做四类任务,在 WorldArena 上拿了第一,比很多模型都强。
开源、60K小时数据、覆盖多种机器人,LingBot-VLA 2.0 在长周期任务上表现出色,值得研究具身智能的你看一看。
人形机器人公司逐际动力融资近2亿美元,专攻大小脑融合技术,已有量产产品Luna和TRON 2,想了解具身智能商业化进展可以看看。
小米开源了Xiaomi-Robotics-U0,能生成场景、迁移轨迹、做视频,WorldArena第一,真机效果提升26%,效率快83倍,值得关注。
这篇论文提出了一个实用的容错框架DAS,专为工业场景下的异构智能体协作设计,解决了累积错误传播的老大难问题。
宇树科技创始人亲自讲机器人的未来方向:它们会像个人电脑一样普及,短期内就能用在家庭、教育和品牌活动里,不是空话。
Robbyant这个视频动作模型直接用视频训练机器人,别家还没见过类似的。论文和代码全公开,搞机器人和具身智能的可以看看。
蚂蚁Robant出了个面向具身AI的模型LingBot-VA 2.0,能预测未来状态并以225Hz实时控制,跟那些从视频生成器改的模型思路完全不一样。
蚂蚁灵波开源了LingBot-Video,专为机器人设计,RBench上超过Wan2.6,推理快3倍,适合做训练数据。
LingBot-Video 刚上 Hugging Face,30B 参数但推理只激活 3B,还加了 7 万小时具身数据,适合做机器人视觉。
蚂蚁灵波开源了新一代具身模型 LingBot-VLA 2.0,在 20 种机器人构型上泛化,GM-100 评测中全面领先 π0.5 和 GR00T N1.7,而且推理速度很快,适合开发者试玩。
今年WAIC太值得去了!展览面积破10万平米,300多款AI新产品首发,还有图灵奖得主坐镇学术论坛。
GloVe和Transformer的创造者Manning要讲语言模型怎么和机器人结合了,想了解具身智能世界模型的可以听听。