模型中美对照多源确认09:33ActiveVision新基准:GPT-5.5和Claude Fable 5主动观察得分不足11%想看最强的AI在实时观察任务上有多弱吗?ActiveVision让GPT-5.5和Claude Fable 5原形毕露,人类碾压它们。#ActiveVision#GPT-5.5#Claude Fable 5#多模态10 个信源在谈事件专题aarXiv cs.AI@Jiarui Zhang 等 6 人11 个信源在谈原文稍后读已读值得跟进有用关注 ActiveVision