Ant LingBot发布6个开源具身AI模型,VLA与世界模型双轨并进

Ant Group Physical AI Task Force: Ant LingBot Dual-Track Strategy of VLA and World Action Models, Open-Source Ecosystem, and the Data Dilemma

精选理由

Ant LingBot一口气开源6个具身模型,VLA和世界模型两条路都在走,但数据和生态是硬骨头。

AI 摘要

蚂蚁集团全资子公司Ant LingBot发布了6个开源具身AI模型,包括视觉-语言-动作(VLA)模型和世界行为模型。VLA模型基于ViT-300M参数,世界模型采用扩散架构预测未来状态。团队称VLA模型在模拟环境成功率比基线高15%,但真实场景数据仅覆盖200种物体。同时面临数据采集成本高、Google和Meta等巨头开源生态竞争压力。

原文 · Pandaily

Ant Group Physical AI Task Force: Ant LingBot Dual-Track Strategy of VLA and World Action Models, Open-Source Ecosystem, and the Data Dilemma

Ant Group wholly owned subsidiary Ant LingBot releases six open-source embodied AI models, pursues parallel VLA and world model routes, but faces data scarcity and ecosystem competition challenges.