№lingbotvla·general
LingBot-VLA
别名
- 首次出现
- 2026-07-08
- 最近出现
- 2026-07-15
- 累计提及
- 12
§ 01综述
LingBot-VLA 是蚂蚁集团旗下 Robbyant 团队开源的视觉-语言-动作(VLA)具身智能基座模型,旨在让机器人通过自然语言指令理解环境并执行精准操作。作为当前少数开源的大规模机器人基础模型之一,它降低了具身智能的研究门槛,并逐步向跨形态、通用化方向发展。
LingBot-VLA近期进展
开源跨形态操作模型:Robbyant 发布了 LingBot 系列的首个开源版本,融合空间感知、具身操作与世界模拟能力,支持从仿真到真实场景的泛化。该模型通过语言指令引导机器人完成复杂任务,如抓取、堆叠等。 原文标题
LingBot-VLA 2.0 发布:2026年7月,团队推出 2.0 版本,参数量达 6B,专注于跨形态机器人操作,涵盖机械臂、灵巧手等多种执行器。该版本在开源社区引发关注,被评价为“从任务执行迈向通用技能”。 原文标题
国内具身智能标杆:IT之家报道称,LingBot-VLA 2.0 是目前国内首个完全开源的 VLA 基座模型,其训练数据和评估基准同步开放,为学术和产业界提供了统一研究平台。 原文标题
当前焦点与观察点
LingBot-VLA 的核心焦点在于“开源”与“通用性”。一方面,它使更多研究者无需从头训练大模型即可开展具身智能实验,加速了技术迭代;另一方面,2.0 版本强调跨形态适应能力,这与多数仅针对单一机器人的 VLA 模型形成差异。然而,其真实环境下的鲁棒性和复杂任务泛化能力仍待验证。此外,该模型的开源许可和商业使用条款也受关注,直接关系到后续生态建设。