模型中美对照08:50用户实测GLM 5.2一周:够用但未来还有更好看看有人实测GLM 5.2一周的真实感受,别被'够用'骗了,他说后面肯定还有更好的。#GLM 5.2#智谱#开源模型#大模型评测andrew chen@andrewchen原文稍后读已读值得跟进有用关注 GLM 5.2
模型中美对照23:37评测Grok 4.5:让它开发大模型评测网站有人正在测Grok 4.5的真实水平——让它写个评测网站,目前Skill调用挺准,来看看能不能真搭出来。#Grok 4.5#大模型评测#Skill调用#编程能力向阳乔木@vista8原文稍后读已读值得跟进有用关注 Grok 4.5
模型中美对照多源确认18:35Arena周榜:claude-fable-5蝉联榜首,国产模型稳定中上游这期榜单告诉你哪家模型综合最强、代码最好、数学最牛。国产的qwen3.7-max-preview在代码榜进了前十,值得看看。#claude-fable-5#qwen3.7-max-preview#ernie-5.1#mimo-v2.5-pro10 个信源在谈事件专题IIT之家11 个信源在谈原文稍后读已读值得跟进有用关注 claude-fable-5