AI 推理能力从片段到完整体系的跃迁,是开发者和安全从业者必须关注的分水岭——Claude Mythos 的防御性开放和 OpenAI 的数学突破,直接改变了模型应用边界,建议点开了解具体案例。
Anthropic 于 2026 年 4 月 7 日发布 Project Glasswing 及 Claude Mythos Preview,该前沿模型网络攻防能力极强,因安全顾虑仅开放给合作伙伴用于防御。OpenAI 则在 5 月 20 日宣布其内部通用推理模型成功推翻数学家 Paul Erdős 的平面单位距离问题猜想。这两件事共同表明,前沿模型在更高抽象层面的可靠推理能力已迈过临界点,能稳定处理完整论证和知识体系,而非仅限片段操作。Claude Mythos Preview 在编码和网络安全评测中表现突出,多数基准测试超越 GPT-5.5。
这次AI 跨过了一个“奇点”! 最近有两个事件值得重点关注: •2026 年 4 月 7 日:A…
这次AI 跨过了一个“奇点”!
最近有两个事件值得重点关注:
•2026 年 4 月 7 日:Anthropic 发布了 Project Glasswing,同时推出了 Claude Mythos Preview。 这是一个尚未正式公开的 前沿模型,其网络攻防能力已经强到一定程度。
以至于 Anthropic 没有选择公开,而是只开放给合作伙伴,用于防御性用途。
•2026 年 5 月 20 日:OpenAI 宣布,其内部的一个通用推理模型,成功推翻了数学家 Paul Erdős 在 1946 年提出的一个平面单位距离问题猜想。
这两件事看起来没什么关系,但其实指向了同一个现象:前沿模型在更高抽象层面的可靠推理能力,已经迈过了一个临界点。
我说的这个“门槛”,指的是模型能够稳定处理的推理单元在不断上移。
简单来说,语言的抽象层级大致是这样的: 字符 → 词语 → 短语 → 句子 → 段落 → 整篇文章 → 完整知识体系。
以前的模型可能连句子都组织不好,现在的顶级模型已经能稳定地处理“段落”和“整篇论证”了。
写一篇文章不只是接龙下一个句子,而是要维持一个核心观点、挑选合适的例子、建立逻辑连接,并让每一部分都服务于整体结构。
Anthropic 的 Mythos 和 OpenAI 的内部模型,正是这种能力跃迁的代表。
它们不再只是针对单个漏洞或单个数学引理进行操作,更是能够把这些零散的片段串起来,形成完整的攻击链或数学证明。
Claude Mythos Preview 是目前 Anthropic 最强、规模也可能是最大的模型,在编码能力上表现非常突出,多数基准测试都超过了 OpenAI 最新的 GPT-5.5。
但最值得注意的是它的网络安全能力,在进攻性安全评测中表现过于亮眼,导致 Anthropic 最终决定不公开这个模型,作为仅提供给关键基础设施企业用于防御。