AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

零样本控制

共 1 条相关 AI 资讯
8月7日
09:21
09:21官方账号arXiv cs.AI@J. de Curtò, Dayani Plasencia, Diego Sánchez, I. de Zarzà
这项研究通过输入消融测试,检查视觉语言模型(VLM)在零样本控制中是否真正依赖视觉输入。在9个直接控制模型、6个结构化局部VLM和1个VLM-MPC层级中,分析了32,874次评分调用。结果显示多数直接控制模型表现负面,常数SLOW策略甚至优于脚本几何控制器。图像仅确定性正对照以0.090米MAE和精确镜像等变性估算前车间距,证明视觉刺激信息充分。后验对称一致性守护者选出的模型在272帧上达到0.954平衡准确率,弃权时提升至0.973。
论文VLM视觉语言模型具身智能

推荐理由:这篇论文用消融实验戳穿了VLM做零样本控制的假象,多数模型其实没在看图像。还给出了一个能到0.973准确率的守护方案,想搞具身智能的值得看。
原文
精选全部日报登录