模型中美对照多源确认11:01Opus 5 基准胜 Fable 5 但实际体验差,Kun Chen 批评指标和训练方法这条推文直指 Opus 5 和 Fable 5 的基准与体验反差,还爆出 Anthropic 新的蒸馏训练路径,以及 RLHF 被弱化导致的体验变化,值得看看。#Opus 5#Fable 5#Anthropic#基准失效10 个信源在谈事件专题orange.ai@oran_ge11 个信源在谈原文稍后读已读值得跟进有用关注 Opus 5