事件专题 · 多源确认

自主改进框架 Prime Agent 助 Opus 5 得分大涨,但现实价值存疑

Prime Agent 是一个能自主改进的递归 Agent 框架。替换外部 Harness 后,Opus 5 的 ARC-AGI-3 评分从 30.2% 升至 95.5%,超过人类专家基线 95.4%。但作者认为,这种面向评分的优化价值有限,在现实场景中不会比 Claude Code 和 Codex 更好。

当前结论

这个框架把 Opus 5 的评分从 30% 刷到 95.5%,但作者觉得换汤不换药,实战未必比 Claude Code 强。

9 个信源41° AI 热度最后更新 2026/8/8 01:32:03

证据链

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情