Claude发布Fable 5.1与Mythos 5.1双模型

Claude Fable 5.1 & Mythos 5.1 同时发布、分工不同! Fable 5.1:通用旗舰,主打编程与知识工作,即日起全量开放 Mythos 5.1:垂直领域模型,面向网络防御者...

精选理由

Anthropic发布Fable 5.1和Mythos 5.1,前者编程能力大幅提升且成本降低25%,后者专注网络安全和生命科学领域。

AI 摘要

Anthropic同时发布Claude Fable 5.1和Mythos 5.1两个模型。Fable 5.1是通用旗舰模型,主打编程与知识工作,已全量开放。Mythos 5.1是垂直领域模型,面向网络防御者和生命科学研究者,仅通过可信访问计划提供。Fable 5.1在Terminal-Bench-Science 0.1基准测试中从26%提升至52.6%,在Terminal-Bench 4.0中从42.0%提升至55.8%。

原文 · shao__meng

Claude Fable 5.1 & Mythos 5.1 同时发布、分工不同! Fable 5.1:通用旗舰,主打编程与知识工作,即日起全量开放 Mythos 5.1:垂直领域模型,面向网络防御者...

Claude Fable 5.1 & Mythos 5.1 同时发布、分工不同! Fable 5.1:通用旗舰,主打编程与知识工作,即日起全量开放 Mythos 5.1:垂直领域模型,面向网络防御者与生命科学研究者,仅通过可信访问计划提供 anthropic.com/claude-fable-a… 性能:Agentic 与科研能力的大幅跃升 Fable 5 vs. Fable 5.1 · Terminal-Bench-Science 0.1 - ~26% vs. 52.6% · Terminal-Bench 4.0 - 42.0% vs. 55.8% 增幅集中在长程、复杂任务:Fable 5.1 "擅长复杂、长时间运行的任务"。 科研能力是叙事重心:5.1 的研究能力"初步展示了 AI 将如何参与科学进步"。 成本:性能提升之外的真正卖点 · 效率曲线:Fable 5.1 在较低 effort 档位即可达到甚至超过 Fable 5 满档的表现。意味着用户可以用更低的推理预算换取同等产出。 · 缓存定价:缓存读取(cache reads)价格降低 75%,传导到实际账单上:典型工作负载成本下降约 25%、高度 agentic 的工作负载最高下降 45% Agentic 应用会反复携带长上下文(工具结果、历史轨迹),缓存读取是其主要成本来源。Anthropic 显然在用"能力 + 价格"双杠杆加速 agent 场景渗透。 EFS:面向企业的隐私-安全新框架 Enterprise Frontier Safeguards (EFS) 是本次最具战略意义的非模型发布: · 企业客户可获得等同于零数据保留(ZDR)的完全隐私; · 同时官方声称仍能保持业界领先的对抗性滥用防护; · 今年秋季开始分阶段推出。 安全护栏的"误报率"优化 · 网络安全相关良性请求的误拦截率下降约 60%; · 基础生物学与医学问题的拒答/降级率下降约 85% Claude @claudeai We’re introducing Claude Fable 5.1 and Claude Mythos 5.1. They're the world’s most advanced models for coding and knowledge work. Your browser does not support the video tag. 🔗 View on Twitter 🔗 View Quoted Tweet 💬 0 🔄 0 ❤️ 1 👀 626 📊 1 ⚡

Claude发布Fable 5.1与Mythos 5.1双模型 · AI 热点