AI 跨过推理奇点:Anthropic 与 OpenAI 前沿模型能力跃迁

这次AI 跨过了一个“奇点”! 最近有两个事件值得重点关注: •2026 年 4 月 7 日:A…

精选理由

AI 推理能力从片段到完整体系的跃迁,是开发者和安全从业者必须关注的分水岭——Claude Mythos 的防御性开放和 OpenAI 的数学突破,直接改变了模型应用边界,建议点开了解具体案例。

AI 摘要

Anthropic 于 2026 年 4 月 7 日发布 Project Glasswing 及 Claude Mythos Preview,该前沿模型网络攻防能力极强,因安全顾虑仅开放给合作伙伴用于防御。OpenAI 则在 5 月 20 日宣布其内部通用推理模型成功推翻数学家 Paul Erdős 的平面单位距离问题猜想。这两件事共同表明,前沿模型在更高抽象层面的可靠推理能力已迈过临界点,能稳定处理完整论证和知识体系,而非仅限片段操作。Claude Mythos Preview 在编码和网络安全评测中表现突出,多数基准测试超越 GPT-5.5。

原文 · berryxia

这次AI 跨过了一个“奇点”! 最近有两个事件值得重点关注: •2026 年 4 月 7 日:A…

这次AI 跨过了一个“奇点”!

最近有两个事件值得重点关注:

•2026 年 4 月 7 日:Anthropic 发布了 Project Glasswing,同时推出了 Claude Mythos Preview。 这是一个尚未正式公开的 前沿模型,其网络攻防能力已经强到一定程度。

以至于 Anthropic 没有选择公开,而是只开放给合作伙伴,用于防御性用途。

•2026 年 5 月 20 日:OpenAI 宣布,其内部的一个通用推理模型,成功推翻了数学家 Paul Erdős 在 1946 年提出的一个平面单位距离问题猜想。

这两件事看起来没什么关系,但其实指向了同一个现象:前沿模型在更高抽象层面的可靠推理能力,已经迈过了一个临界点。

我说的这个“门槛”,指的是模型能够稳定处理的推理单元在不断上移。

简单来说,语言的抽象层级大致是这样的: 字符 → 词语 → 短语 → 句子 → 段落 → 整篇文章 → 完整知识体系。

以前的模型可能连句子都组织不好,现在的顶级模型已经能稳定地处理“段落”和“整篇论证”了。

写一篇文章不只是接龙下一个句子,而是要维持一个核心观点、挑选合适的例子、建立逻辑连接,并让每一部分都服务于整体结构。

Anthropic 的 Mythos 和 OpenAI 的内部模型,正是这种能力跃迁的代表。

它们不再只是针对单个漏洞或单个数学引理进行操作,更是能够把这些零散的片段串起来,形成完整的攻击链或数学证明。

Claude Mythos Preview 是目前 Anthropic 最强、规模也可能是最大的模型,在编码能力上表现非常突出,多数基准测试都超过了 OpenAI 最新的 GPT-5.5。

但最值得注意的是它的网络安全能力,在进攻性安全评测中表现过于亮眼,导致 Anthropic 最终决定不公开这个模型,作为仅提供给关键基础设施企业用于防御。

AI 跨过推理奇点:Anthropic 与 OpenAI 前沿模型能力跃迁 · AI 热点