主要来源shao__meng
查看原文事件专题 · 多源确认
Claude Opus 4.8 发布:可靠性提升,编码与Agent任务更强
Anthropic 在宣布 H 轮 650 亿美金融资当天,发布了 Claude Opus 4.8。该模型在编码、Agent 任务和知识工作方面显著提升,SWE-Bench Pro 达到 69.2%,Terminal-Bench 2.1 为 74.6%。关键改进包括更诚实的自我监控(误判减少 4 倍)、更稳定的 Agent 协作质量,以及计算机/浏览器 Agent 能力提升(OSWorld-Verified 83.4%)。同时引入 Claude Code Dynamic Workflows,支持从单 Agent 到规划、并行、验证的协作模式。定价不变,即日可用。
当前结论
做复杂编码、Agent 和浏览器自动化的团队可以直接升级——Opus 4.8 在诚实度和任务完成率上都有实质提升,且价格不变,值得立即试用。
11 个信源83° AI 热度最后更新 2026/5/29 00:55:26
证据链
相关来源 1宝玉
查看原文相关来源 2berryxia
查看原文相关来源 3Claude
查看原文相关来源 4IT之家
查看原文相关来源 5AI Will
查看原文相关来源 6Alex Albert
查看原文相关来源 7Mike Krieger
查看原文相关来源 8Jerry Liu
查看原文相关来源 9GitHub
查看原文相关来源 10Genspark
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。