模型中美对照14:05Moonshot AI新基准PerceptionBench:多模态模型视觉感知准确率不足60%Moonshot AI 出了个新测试 PerceptionBench,专门查 AI 的“眼神”。结果最强模型 GPT-5.6 Sol 准确率也不到 60%,而且很多错是从看图时就错了。#PerceptionBench#Moonshot AI#GPT-5.6 Sol#多模态官方账号Decoder@Jonathan Kemper原文稍后读已读值得跟进有用关注 PerceptionBench
技巧Agent 与开发者官方一手06:30Moonshot PerceptionBench评估多模态模型教程想测自家视觉模型?用Moonshot的PerceptionBench,从OCR到幻觉检测都覆盖,跟着这教程搭流程就行。#PerceptionBench#Moonshot#多模态#视觉评估官方一手marktechpost@Sana Hassan原文稍后读已读值得跟进有用关注 PerceptionBench