7月22日
01:41
7月9日
02:32
02:32官方账号Epoch AI@EpochAIResearch
精选
智谱AI的GLM-5.2在Epoch Capabilities Index上获得152分,是评估过的所有开源权重模型中的最高分。该分数仍低于7个多月前发布的Gemini 3 Pro。这一结果显示出开源模型在能力基准上的进展,但与顶级闭源模型仍有差距。
事件专题

推荐理由:智谱开源模型GLM-5.2在能力指数上拿到开源最高152分,不过还是比不过7个月前发布的Gemini 3 Pro,差距一目了然。
7月7日
01:31
01:31官方账号Decoder@Matthias Bastian
GPT-4在Epoch Capabilities Index上保持领先约一年,远超其他模型。自2024年2月Claude 3 Opus登顶以来,榜首已易手17次,中位停留时间仅七周。当前模型间的竞争更激烈,但能力增益却在缩小。

推荐理由:AI模型排行榜大洗牌,GPT-4曾经稳坐一年,现在每七周就换龙头,竞争白热化但进步空间在缩水。
7月3日
10:59
6月16日
10:07
10:07Gary Marcus@GaryMarcus
Anthropic 发布的 Claude Fable 5 在 Epoch AI 的 Epoch Capabilities Index 上获得 161 分,以 1 分之差超越 GPT-5.5 Pro 的 160 分。这是 Anthropic 一年多来首次在该基准上领先。该指数综合评估模型能力,当前最高分为 161。尽管成绩创下新高,但专家指出进步幅度仍属渐进。
事件专题

推荐理由:Claude Fable 5 刚在 Epoch 能力指数上以 161 分微弱领先 GPT-5.5 Pro,这是 Anthropic 一年多来首次登顶,你可以看看它具体强在哪。