模型Agent 与开发者多源确认精选02:39Harvey LAB-AA v1.1 加入幻觉检查,Grok 4.7 以 9.4% 登顶法律基准法律基准加了幻觉门槛后排名大洗牌:Muse Spark 本来领先,过滤幻觉后掉到第二,GPT-6 Astra 几乎不缩水。看各家法律任务幻觉差距挺有意思。#Harvey LAB#幻觉#法律AI#Grok 4.710 个信源在谈事件专题官方账号Artificial Analysis@ArtificialAnlys11 个信源在谈原文稍后读已读值得跟进有用关注 Harvey LAB