论文多源确认11:38人类注视与视觉语言模型注意力在安全场景中的比较研究想知道AI能不能像人一样在危险场景下抓住关键区域?这篇论文用GPT-4o、Gemini Pro等模型做了对比,发现它们不靠眼动训练数据就能大致预测人类注视点。#GPT-4o#Gemini Pro#Gemini Flash#Claude10 个信源在谈事件专题aarXiv: OpenAI@Marta Vallejo, Siwen Wang11 个信源在谈原文稍后读已读值得跟进有用关注 GPT-4o