Anthropic 发布 Claude Fable 5,安全版超级模型上线

兄弟们,大家没有等来Mythos! 但等来了同门兄弟Fable 5啊! Anthropic把Myt…

精选理由

Anthropic 用 Fable 5 证明了顶级 AI 不必在能力与安全间二选一,做 AI 安全或前沿模型应用的开发者值得关注这套精准 safeguard 方案。

AI 摘要

Anthropic 未发布传闻中的 Mythos 模型,但推出了其安全版本 Claude Fable 5。该模型在软件工程、知识工作、科研和视觉等基准测试中几乎全线 SOTA,尤其在长任务上表现突出。为保障安全,模型在 cyber、生物化学等敏感领域会自动降级到 Opus 4.8,平均每 20 次对话触发一次。同时,Anthropic 向少数可信的网络安全和关键基础设施团队开放了完全版 Mythos 5,并计划逐步扩大访问。此举打破了“越强越危险”的固有观念,展示了能力与安全可兼得。

原文 · berryxia

兄弟们,大家没有等来Mythos! 但等来了同门兄弟Fable 5啊! Anthropic把Myt…

兄弟们,大家没有等来Mythos! 但等来了同门兄弟Fable 5啊!

Anthropic把Mythos级别的超级怪物直接做成安全版扔给全世界用,把“越强越危险”的 说法抛在脑后!

Claude Fable 5今天全网开闸,基准测试几乎全线SOTA,尤其软件工程、知识工作、科研和视觉这些硬活儿,长任务越复杂它领先得越离谱。

他们自己也承认这模型太猛,cyber、生物化学、蒸馏这些窄领域会自动fallback到Opus 4.8,平均每20次对话才触发一次,还会老实告诉你。

同时给一小撮可信的cyber防御和关键基础设施团队放出完全版Mythos 5,后面还会逐步扩大受信任访问。

以前大家都觉得前沿模型要么锁死不给用,要么一放就出事,结果Anthropic用这套精准safeguard直接证明:真正顶级的AI从来不是能力跟安全二选一,是把两者同时拉到极致。