主要来源berryxia
查看原文事件专题 · 多源确认
Anthropic 发布 Claude Fable 5,安全版超级模型上线
Anthropic 未发布传闻中的 Mythos 模型,但推出了其安全版本 Claude Fable 5。该模型在软件工程、知识工作、科研和视觉等基准测试中几乎全线 SOTA,尤其在长任务上表现突出。为保障安全,模型在 cyber、生物化学等敏感领域会自动降级到 Opus 4.8,平均每 20 次对话触发一次。同时,Anthropic 向少数可信的网络安全和关键基础设施团队开放了完全版 Mythos 5,并计划逐步扩大访问。此举打破了“越强越危险”的固有观念,展示了能力与安全可兼得。
当前结论
Anthropic 用 Fable 5 证明了顶级 AI 不必在能力与安全间二选一,做 AI 安全或前沿模型应用的开发者值得关注这套精准 safeguard 方案。
11 个信源91° AI 热度最后更新 2026/6/9 22:47:04
证据链
相关来源 1Alex Albert
查看原文相关来源 2elvis
查看原文相关来源 3宝玉
查看原文相关来源 4rohanpaul_ai
查看原文相关来源 5Decoder
查看原文相关来源 6Claude
查看原文相关来源 7The Rundown AI
查看原文相关来源 8OpenRouter
查看原文相关来源 9Replicate
查看原文相关来源 10Aadit Sheth
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。