03:01官方一手Anthropic: Research(资讯)精选Anthropic前沿红队发布研究,量化了GPT-4和Claude 3.5等大模型对N-day漏洞利用的效率影响。测试涉及多个已知漏洞样本,发现模型能显著缩短利用代码的编写时间。研究报告同时强调了当前安全对齐的不足,并给出了缓解建议。论文AnthropicClaudeGPT-410 个信源在谈事件专题推荐理由:Anthropic自家红队实测,发现Claude和GPT-4都能帮人更快写出漏洞利用代码。想知道风险多大?看这篇。原文稍后读已读值得跟进有用关注 Anthropic
03:00官方一手Anthropic: Research(资讯)精选Anthropic前沿红队发布报告,利用LLM ATT&CK Navigator框架系统分析AI系统可能面临的网络威胁。该导航器将攻击者行为映射到战术和技术层面,涵盖提示注入、模型窃取、训练数据投毒等攻击类型。报告为安全团队提供了针对AI特定威胁的防御策略。行业AnthropicLLM ATT&CK NavigatorAI安全10 个信源在谈事件专题推荐理由:Anthropic红队用ATT&CK模型帮你理清AI系统被攻击的点,搞安全的人都该看看。原文稍后读已读值得跟进有用关注 Anthropic
02:59官方一手Anthropic: Research(资讯)Anthropic前沿红队于2026年5月22日发布了一份评估报告,系统测试了LLM自主开发软件漏洞利用的能力。评估覆盖了多种前沿模型,要求其在无人类协助的情况下发现并编写针对真实漏洞的利用代码。结果显示,部分模型在简单场景中成功开发了可利用漏洞,但复杂场景下表现有限。该研究为理解前沿AI模型的网络攻击能力提供了关键基准。论文AnthropicAI安全漏洞利用10 个信源在谈事件专题推荐理由:Anthropic自己测了AI能不能写漏洞利用代码,结果有些还真能搞出来,建议安全从业者看看。原文稍后读已读值得跟进有用关注 Anthropic
02:44Lenny Rachitsky@lennysan本期播客嘉宾包括谷歌DeepMind首席科学家Jeff Dean、OpenAI的ChatGPT生产力负责人Tara Seshan、Anthropic研究产品负责人Dianne Penn、Claude Code/Cowork工程负责人Fiona Fung、Codex PM与工程负责人Andrew Ambrosino,以及Netflix CPTO Elizabeth Stone。多位AI公司高管将分享前沿视角。行业播客Jeff DeanGoogle DeepMind10 个信源在谈事件专题推荐理由:想听谷歌DeepMind、OpenAI、Anthropic等公司高管聊内部视角?这场播客阵容超强,值得蹲。原文稍后读已读值得跟进有用关注 播客
23:33Julien Chaumond@julien_cAnthropic的Dario Amodei、OpenAI的Sam Altman、DeepMind的Demis Hassabis和Mistral的Arthur Mensch四位AI公司CEO,据Politico报道,将于今日进行一场2小时的午餐会面。此次闭门会议可能涉及行业合作、政策协调或技术方向讨论。四位领导者代表当前最前沿的AI机构,此举引发市场对行业格局变化的猜测。行业AnthropicOpenAIDeepMind10 个信源在谈事件专题推荐理由:四大AI巨头CEO私下碰头,半小时的午餐可能聊出行业大动静,想了解风向就看这个。原文稍后读已读值得跟进有用关注 Anthropic
14:19IT之家(博客/媒体)73°Anthropic 于 5 月 13 日宣布,Claude Agent SDK(包括通过第三方应用及 'claude -p' 调用)的计费方式将从标准订阅调整为按 API Token 用量计费,原定 6 月 15 日生效。开发者 Matthew Diakonov 分析,若以 Opus 模型作为主编码助手,第一周就会超过盈亏平衡点。代码编辑器 Zed 团队也警告用户这是一次“重大成本增加”。Anthropic 于 6 月 15 日更新支持页面,宣布暂停该变更,并表示目前没有任何变化。行业AnthropicClaude Agent SDKOpus10 个信源在谈事件专题推荐理由:Anthropic 听取了开发者意见,暂停了 Claude Agent SDK 的 Token 计费变更,避免了成本飙升。如果你在用这个 SDK,现在可以松口气了。原文稍后读已读值得跟进有用关注 Anthropic
11:02AI Will@FinanceYF5Anthropic CEO Dario Amodei 发表政策长文,指出 AI 发展速度远超政策制定速度,必须强制介入。他点名了五个领域,认为每个都在重写规则。文章呼吁全球政策机器加速,以应对当前的紧迫形势。行业AnthropicDario AmodeiAI监管10 个信源在谈事件专题推荐理由:Anthropic 老板亲自喊话,说 AI 跑太快政策跟不上,还点名了五个关键领域。搞 AI 的人值得关注。原文稍后读已读值得跟进有用关注 Anthropic
10:44官方账号arXiv cs.AI@Nicola FrancoAnthropic发布了对两个前沿模型Fable 5和Opus 4.8的红队研究。研究使用HackAgent框架,对7,826个有害意图进行自动化越狱攻击,覆盖十类危害。最强自适应树状攻击在Opus 4.8上成功率达11.5%,而在Fable 5上仅为6.1%。两个模型分别产生了1,620和702个经专家确认的有害输出。结论表明,即使经过充分测试的前沿模型仍可在持续自动化攻击下被可靠破解。论文AnthropicFable 5Opus 4.810 个信源在谈事件专题推荐理由:Anthropic公开了Fable 5和Opus 4.8的对抗性测试结果:树状攻击破Opus 4.8的11.5%,但Fable 5更抗打,仅6.1%。别被整体数字骗了,残存风险不小。原文稍后读已读值得跟进有用关注 Anthropic
10:10IT之家(博客/媒体)73°微软正将 Copilot Cowork 智能体转为按使用量计费,并探索 DeepSeek V4 微调版作为更低成本替代方案。目前 Anthropic Fable 5 输出定价为 50 美元/百万 token,而 DeepSeek V4 Pro 仅 0.87 美元/百万 token,价差约 57 倍。微软承诺该模型将完全托管在 Azure 上,确保企业级安全合规。预计未来几周内公布最终模型选择。AI产品微软Copilot CoworkDeepSeek V410 个信源在谈事件专题推荐理由:微软嫌 Claude 和 GPT 太贵,打算用 DeepSeek V4 微调版,价格差了 57 倍,企业用户能省一大笔钱。原文稍后读已读值得跟进有用关注 微软
10:01Fireworks AI@FireworksAI_HQFireworks AI 推出 GLM-5P2 模型,强调基准测试仅是参考,真正的评估应基于实际代码库、提示词和延迟 SLO。该模型支持直接替换 OpenAI 或 Anthropic 兼容客户端(如 accounts/fireworks/models/glm-5p2),用户可在真实场景中测试。Fireworks AI 建议开发者下载模型并尝试在自有代码库上运行,以验证实际性能。推文附有详细博客链接(fireworks.ai/blog/glm-5p2)供进一步了解。AI模型Fireworks AIGLM-5P2OpenAI10 个信源在谈事件专题推荐理由:Fireworks AI 让你用 GLM-5P2 直接在代码库上跑分,别光看基准,试试自己的提示词和延迟原文稍后读已读值得跟进有用关注 Fireworks AI
09:58Viking@vikingmuteAnthropic 升级了其流行的 frontend design skill(GitHub 仓库),新版本明确要求避免 AI 常见默认风格:暖米色背景(#F4F1EA A)、高对比 serif 字体和 terracotta 强调色。该 skill 强调原创性,提供更深入的方法论指导,帮助用户设计非模板化的 UI。用户可直接试用新版 skill 来提升设计独特性。技巧Anthropicfrontend design skillUI设计3 个信源在谈事件专题推荐理由:Anthropic 把前端设计 skill 升级了,教你避开 AI 那套暖米色+serif 的审美,更强调原创性,做 UI 的朋友可以试试。原文稍后读已读值得跟进有用关注 Anthropic
04:19官方账号Anthropic@AnthropicAIAnthropic 研究发现,根据提问和词汇判断的领域专家更可能在编程中成功。但中级用户与专家之间的成功率差距相当小。这表明具备领域熟练度就足以在特定领域成功编码。行业Anthropic编程助手领域知识10 个信源在谈事件专题推荐理由:Anthropic 研究告诉你,不用非得是顶尖专家,领域懂行就能用好 AI 写代码,中级用户也能达到差不多的效果。原文稍后读已读值得跟进有用关注 Anthropic
04:19官方账号Anthropic@AnthropicAIAnthropic发布经济研究,提出一套框架用于跟踪Claude Code的扩展情况。该框架分析用户画像、任务类型及任务价值的变化。研究还探讨了领域专业知识对会话成功率的影响。报告基于Claude Code的实际使用数据,为理解编码助手的经济影响提供新视角。论文AnthropicClaude Code经济研究10 个信源在谈事件专题推荐理由:Anthropic专门发了一篇研究,分析大家怎么用Claude Code、任务值多少钱,还聊了专业知识对结果的影响,挺有启发的。原文稍后读已读值得跟进有用关注 Anthropic
04:03Gary Marcus@GaryMarcusOpenAI市场份额已降至50%以下,微软公开寻求更便宜的替代方案。Gary Marcus指出OpenAI资金紧张且烧钱严重,认为投资者更倾向于Anthropic而非OpenAI。他预测OpenAI将以约30%的估值被微软或亚马逊收购。行业OpenAIMicrosoftAnthropic10 个信源在谈事件专题推荐理由:Gary Marcus直言OpenAI市值可能缩水七成,微软已经在找替代品,反映了AI行业格局变化。原文稍后读已读值得跟进有用关注 OpenAI
04:02Gary Marcus@GaryMarcus微软正在探索将DeepSeek作为Copilot Cowork的底层模型,替代OpenAI和Anthropic。同时Copilot Cowork转向基于使用量的定价模式,微软表示有用户每周执行数百个任务,成本可能非常高。这一举动被分析认为伤害了OpenAI和Anthropic的潜在IPO。事件涉及Jevons悖论,即效率提升可能导致总用量增加。行业微软DeepSeekOpenAI10 个信源在谈事件专题推荐理由:微软可能换掉OpenAI和Anthropic,改用DeepSeek给Copilot Cowork,还改了按用量收费。这事直接影响两家公司上市计划,值得关注。原文稍后读已读值得跟进有用关注 微软
03:39@koltregaskes@koltregaskes73°美国以担忧Fable和Mythos被转移至中国、俄罗斯等外国军事情报用户为由采取行动。Anthropic回应称绕过仅暴露其他公开模型也能发现的小安全漏洞。网络安全专家Katie Moussouris驳斥称,报告行为更像正常漏洞发现与修补而非新威胁。若无更强机密证据,此举似乎是在事实未定前对前沿模型执行出口管制。事件提醒封闭AI访问是许可而非所有权,开源和本地选项更重要。行业ClaudeFable 5Anthropic10 个信源在谈事件专题推荐理由:美国禁Claude Fable 5,但公开证据站不住脚,专家说就是普通漏洞,别急着信。原文稍后读已读值得跟进有用关注 Claude
03:36@koltregaskes@koltregaskes用户Kolt Regaskes在X上爆料,他在通过Linear和Github连接器使用ChatGPT时,仅讨论了Anthropic的新闻,却发现ChatGPT的思考内容被审查。OpenAI未公开审查原因。该事件引发对AI内容监管和连接器权限的讨论。AI产品ChatGPTOpenAI内容审查10 个信源在谈事件专题推荐理由:ChatGPT居然在你用第三方工具时偷偷审查内容,连聊Anthropic都要管,这太离谱了,赶紧看看怎么回事。原文稍后读已读值得跟进有用关注 ChatGPT
03:36@koltregaskes@koltregaskes88°美国政府以国家安全和越狱漏洞为由,强制Anthropic关闭Fable 5和Mythos 5模型。指令仅基于口头证据,未提供具体技术细节。Anthropic声称该漏洞很窄,且GPT-5.5也能实现相同功能。同时禁止所有外国人访问,包括Anthropic的外籍员工。此事发生在Anthropic拒绝与五角大楼签订军事监控合同四个月之后。行业AnthropicFable 5Mythos 510 个信源在谈事件专题推荐理由:美国政府让Anthropic关了两个模型,理由含糊,还禁止外国人访问。有人猜是因为Anthropic之前没接五角大楼的军事合同。原文稍后读已读值得跟进有用关注 Anthropic
03:28AI Engineer@aiDotEngineerOpenAI、Anthropic、Google DeepMind、Amazon AGI Labs、Zai和MiniMax共六家前沿AI实验室确认参加2025年World's Fair。活动将于6月29日至7月2日在旧金山举行,由ai.engineer主办。这是模型开发者与基于这些模型构建应用的开发者首次同场交流。行业OpenAIAnthropicGoogle DeepMind10 个信源在谈事件专题推荐理由:六家顶尖AI实验室要凑一块儿了,6月底旧金山,模型开发者直接和做应用的聊,机会难得。原文稍后读已读值得跟进有用关注 OpenAI
01:23kimmonismus@kimmonismus英国首相Keir Starmer向特朗普政府请求豁免,允许英国国民和公司重新访问Anthropic的最先进AI模型。一位特朗普政府官员向《纽约邮报》表示,即使是G7盟友也不予例外,称给予豁免“完全不合逻辑”。美国正与Anthropic及其CEO Dario Amodei直接谈判解决禁令问题,但此举表明前沿AI模型已被视为战略国家安全资产,商业获取可能变为地缘政治特权。行业Anthropic前沿AI国家安全10 个信源在谈事件专题推荐理由:美国把前沿AI当战略资产,连英国盟友都吃闭门羹,这事关全球AI权力格局,你应该看看。原文稍后读已读值得跟进有用关注 Anthropic
21:55kimmonismus@kimmonismusAxios报道,行业担忧白宫对Anthropic最新模型的出口管制将损害整个美国AI产业。德意志银行Jim Reid指出,无法依赖可能被关闭的技术。若企业担心OpenAI、Anthropic和Google的未来前沿模型被一夜限制,他们将加速转向多样化,这为开源模型带来重大优势。行业Anthropic开源模型出口管制10 个信源在谈事件专题推荐理由:美国政府对Anthropic下手的后果:企业开始转向开源模型,省得哪天被切断。原文稍后读已读值得跟进有用关注 Anthropic
17:49官方账号Decoder@Maximilian SchreinerAnthropic 取消了原计划为 Claude Agent SDK 推出的独立计费系统。该 SDK 和第三方应用将继续从常规订阅限额中扣费。此前 Anthropic 因计费变更引发用户不满,此次调整正值与 OpenAI 的价格竞争加剧之际。行业AnthropicClaude Agent SDKOpenAI10 个信源在谈事件专题推荐理由:Anthropic 悬崖勒马,放弃了 Claude Agent SDK 的独立计费,稳住用户比在价格战前惹毛他们更重要。原文稍后读已读值得跟进有用关注 Anthropic
16:00AI Will@FinanceYF5Anthropic总裁Daniela Amodei在社交平台回应开发者提问,解释评估AI模型质量的核心维度。她提到模型的安全对齐能力与任务实用性是区分好坏的关键。该讨论未涉及具体基准或数字,聚焦于定性标准。行业Anthropic模型评估AI安全10 个信源在谈事件专题推荐理由:想了解模型评估的行业视角?Anthropic高层直接聊好模型和坏模型的标准。原文稍后读已读值得跟进有用关注 Anthropic
15:58AI Will@FinanceYF5Anthropic总裁Daniela Amodei在社交媒体上分享了对模型质量的看法。她区分了好模型与差模型的特征。该讨论引发了行业对模型评估标准的关注。行业AnthropicDaniela Amodei模型评估10 个信源在谈事件专题推荐理由:Anthropic老大亲自聊好模型的标准,听听内部视角。原文稍后读已读值得跟进有用关注 Anthropic
15:31kimmonismus@kimmonismus73°Anthropic顶级安全团队飞往华盛顿,与特朗普政府就Claude Fable 5出口管制谈判,周一会议未达成协议。商务部长Howard Lutnick从G7峰会电话参与,Anthropic联合创始人Tom Brown和外部事务主管Sarah Heck主导讨论。核心分歧在于Fable 5的护栏能否被移除解锁更强大的Mythos能力,NSA认为可行,Anthropic认为风险被夸大。目前无下一步清晰计划。行业AnthropicClaude Fable 5Mythos10 个信源在谈事件专题推荐理由:Anthropic的Fable 5出口管制僵局,NSA和Anthropic对模型安全看法打架,局势微妙。原文稍后读已读值得跟进有用关注 Anthropic
14:10kimmonismus@kimmonismus72°Anthropic 员工今日在华盛顿与特朗普政府会面,试图解决模型下线争议。CNBC 报道称 Anthropic 表示发布前已与政府机构合作并获得部署批准,但上周五下午 1 点政府突然下令关闭模型,理由是未指明的国家安全威胁,随后几小时发出正式出口管制信函。指令范围极广,Anthropic 不得不暂停所有外国公民访问,包括美国境内,最终对所有人下线。双方说法截然不同:政府认为 Anthropic 未认真对待关切且沟通不当,Anthropic 则称被模糊指令蒙蔽。此次会议结果可能决定 Fable 5 和 Mythos 5 的去留。行业AnthropicFable 5Mythos 510 个信源在谈事件专题推荐理由:Anthropic的Fable 5和Mythos 5刚上线就被政府叫停,双方各执一词,今天华盛顿会面可能决定模型命运。原文稍后读已读值得跟进有用关注 Anthropic
13:58官方账号Simon Willison’s Weblog(博客/媒体)73°研究人员用包含已知 CVE 的开源代码及故意植入漏洞的新代码,要求 Claude Fable 5、Mythos 和 Opus 审查安全。Fable 5 拒绝后,他们改为要求“修复此代码”,经多步手动操作转化为测试补丁的脚本。Kate Moussouris 指出这是防御性修复,而非越狱,出口管制将限制模型修复安全漏洞的关键能力。该管制基于对 AI 制造网络攻击的恐惧,却可能阻碍防御者使用 AI 完成从发现到修复的日常流程。行业Claude Fable 5Claude MythosAnthropic10 个信源在谈事件专题推荐理由:出口管制居然把“修代码漏洞”当成了越狱,这反而让防御者没法用 AI 修安全 bug,太讽刺了。原文稍后读已读值得跟进有用关注 Claude Fable 5
13:55@hebbia@hebbia71°在Hebbia金融服务业基准测试中,Anthropic的Fable 5模型总分超过所有其他前沿模型。该模型在基于文档的推理任务上提升显著,并在图表与表格解读、问题解决两个子项中取得最高分。测试结果来自Hebbia发布的金融行业专属评测集,涵盖多个复杂金融场景。AI模型Fable 5AnthropicHebbia10 个信源在谈事件专题推荐理由:Hebbia测了金融场景,Fable 5在文档推理和图表解读上碾压其他模型,搞金融AI的可以看看具体分数对比。原文稍后读已读值得跟进有用关注 Fable 5
13:45kimmonismus@kimmonismus推文透露,在早期阶段,Cursor曾占据Anthropic收入的40%到50%。Claude Code最初只是一个研究项目,并非产品。这条信息反映了AI创业公司间收入依赖关系的变化速度。行业CursorAnthropicClaude Code10 个信源在谈事件专题推荐理由:看一段AI行业冷知识:Cursor早期竟给Anthropic贡献了将近一半收入,Claude Code那时还是个研究项目。原文稍后读已读值得跟进有用关注 Cursor
13:40kimmonismus@kimmonismus81°Anthropic因美国出口管制被迫将其顶级模型Mythos和Fable下线。公司现派遣高级技术人员前往华盛顿,与白宫沟通,试图说服官员这些模型可以被安全控制。这一事件成为实时检验AI地缘政治的案例。Axios报道了该动态。行业AnthropicMythosFable10 个信源在谈事件专题推荐理由:Anthropic的旗舰模型被强制下线,派技术团队去华盛顿谈判,这件事直接反映了AI出口管制的实际影响。原文稍后读已读值得跟进有用关注 Anthropic
13:34官方一手Claude Code: GitHub Releases@ashwin-ant精选Claude Code v2.1.178 新增 Tool(param:value) 语法,支持用通配符匹配工具输入参数,例如 Agent(model:opus) 可限制子代理模型。修复了子代理多个问题:查看转录时展示工具结果与进度、消息不丢失、后台运行不再重启。改进了自动模式,子代理生成前由分类器评估,避免绕过审查。修复了因 WebSocket/OAuth 文件描述符继承导致的内存溢出崩溃。改进了嵌套 .claude/skills 加载与命名冲突处理。AI产品Claude CodeAnthropicv2.1.17810 个信源在谈事件专题推荐理由:Anthropic 给 Claude Code 打了补丁,新增用参数通配符限制子代理,修了一堆子代理和崩溃的 bug,后台任务也不会重启了。原文稍后读已读值得跟进有用关注 Claude Code
13:00AI Will@FinanceYF5Anthropic聘请网络安全专家审查亚马逊对Fable 5的发现,并反驳政府叙事,该专家被政府视为“激进民主党人”。Axios报道称,事件核心并非模型越狱,而是Anthropic与特朗普政府沟通断裂。公司官员表示双方“说不同语言”,部分支持者如今感到被辜负。Anthropic员工已与商务部、CIA及科学顾问会面,讨论网络行政令合规。行业AnthropicFable 5AI安全10 个信源在谈事件专题推荐理由:Anthropic的Fable 5模型引发政企博弈,政府关系比技术问题更棘手,值得关注AI安全的监管动态。原文稍后读已读值得跟进有用关注 Anthropic
12:59AI Will@FinanceYF5Axios报道指出,Anthropic与特朗普政府之间的信任危机已超越模型越狱技术争议。该信任危机导致Anthropic失去关键政治支持者,可能影响其AI安全协议的执行。报道强调政治信任问题比曾热议的模型安全漏洞更紧迫。行业Anthropic特朗普政府AI安全10 个信源在谈事件专题推荐理由:Anthropic这次不是输在技术,而是丢了政治信任。看看Axios怎么扒的,挺有意思。原文稍后读已读值得跟进有用关注 Anthropic
11:50官方账号Simon Willison’s Weblog(博客/媒体)白宫发布关于Anthropic模型Fable(即Claude)的越狱测试报告。网络安全专家Katie Moussouris指出,当被要求“审查代码的安全问题”时,Fable拒绝执行,但改为“修复此代码”的指令后,模型反而配合完成。Moussouris认为这只是模型按预期工作的安全防御行为。该事件凸显了AI安全测试中提示词工程的重要性。行业AnthropicClaudeFable10 个信源在谈事件专题推荐理由:白宫测了Anthropic的Claude(代号Fable),发现它不帮你找漏洞但愿意直接修代码。安全专家说这反而是正常防御,挺反直觉的。原文稍后读已读值得跟进有用关注 Anthropic
11:49官方一手歸藏(guizang.ai)@op7418精选Anthropic暂停了原定于六月实施的Agent SDK额度变更。用户仍可在基于Agent SDK开发的第三方客户端(如CodePilot)上使用Claude订阅额度。此前的计划曾引起用户担忧,该决定受到社区欢迎。行业AnthropicClaudeAgent SDK10 个信源在谈事件专题推荐理由:Anthropic暂缓了扣订阅额度的计划,用Claude Code第三方客户端的朋友们可以放心继续用了。原文稍后读已读值得跟进有用关注 Anthropic
10:25IT之家(博客/媒体)Anthropic 宣布自7月8日起,要求 Claude Free、Claude Pro 和 Claude Max 用户完成年龄或身份验证,暂不涉及 Teams 和 Enterprise 版本。验证方式包括提供官方证件或扫描面部信息。官方强调不出售用户数据、保持无广告模式。AI产品AnthropicClaude身份验证10 个信源在谈事件专题推荐理由:Anthropic 要求 Claude 用户从下月起刷脸验证身份,免费版和付费版都要,不想被卡住得提前了解。原文稍后读已读值得跟进有用关注 Anthropic
10:19小互@imxiaohuAnthropic 宣布从6月15日起,Claude Pro 和 Max 订阅用户的 Agent SDK 及 Claude-p 使用量不再占用原有对话配额,而是获得独立的月度专用额度。Pro 用户获 $20,Max 5x 用户获 $100 额度,用于运行 Claude-p、自定义 Agent SDK 脚本或第三方 Agent 应用。额度用完才扣其他费用,未用完不滚存,需一次性手动领取后自动续期。AI产品ClaudeAgent SDKAnthropic10 个信源在谈事件专题推荐理由:Claude 订阅户注意了,现在跑 Agent 任务有单独额度,Pro 每月多 $20,Max 用户 $100,不抢日常对话池子,赶紧去领。原文稍后读已读值得跟进有用关注 Claude
10:07Gary Marcus@GaryMarcusAnthropic 发布的 Claude Fable 5 在 Epoch AI 的 Epoch Capabilities Index 上获得 161 分,以 1 分之差超越 GPT-5.5 Pro 的 160 分。这是 Anthropic 一年多来首次在该基准上领先。该指数综合评估模型能力,当前最高分为 161。尽管成绩创下新高,但专家指出进步幅度仍属渐进。AI模型Claude Fable 5GPT-5.5 ProAnthropic10 个信源在谈事件专题推荐理由:Claude Fable 5 刚在 Epoch 能力指数上以 161 分微弱领先 GPT-5.5 Pro,这是 Anthropic 一年多来首次登顶,你可以看看它具体强在哪。原文稍后读已读值得跟进有用关注 Claude Fable 5
10:04官方一手arXiv: Anthropic@David Huang, Jaewon Chang, Avidan Shah, Prateek Mittal, Chawin Sitawarin这篇论文揭示了对快速响应(RR)框架的投毒攻击方法,RR框架部署于生产系统(如Anthropic的ASL-3安全防护),用于持续改进越狱检测分类器。攻击者通过在越狱样本中注入提示词,可以渗透训练管道,实现两种攻击目标:第一种是针对性投毒,在无害样本上制造假阳性(分类为越狱),特定特征(如格式、主题、关键词)可触发。第二种是基于概念的后门攻击,在存在后门触发器的越狱输入上诱导假阴性,甚至能泛化到防御方已训练过的攻击策略。论文提出的Omission Attack利用了一个新现象:训练时缺少特定概念的unsafe样本,会导致分类器将该概念的出现与safe标签错误关联。在仅1%的投毒率下,两种攻击分别实现高达100%的假阳性率和96%的假阴性率。论文Rapid ResponseAnthropic投毒攻击10 个信源在谈事件专题推荐理由:这篇论文讲了对Anthropic等用的越狱检测防御框架的投毒攻击方法,投毒率才1%就能让检测器几乎失效,搞安全的一定要看。原文稍后读已读值得跟进有用关注 Rapid Response
09:06IT之家(博客/媒体)73°Anthropic公司高层于周一与特朗普政府官员举行会谈,希望解除对美国最新大模型Fable 5的出口禁令。该模型因被指存在安全漏洞,于上周五被禁止向境外用户开放。Anthropic辩称漏洞影响有限,且其他公开模型也能复现同类问题。近80名技术专家联名致信政府反对该禁令,认为此举会让防御方失去关键工具。一名官员警告,若僵持不下,未来新模型上线可能都需要政府审批。行业AnthropicFable 5Mythos10 个信源在谈事件专题推荐理由:Anthropic的Fable 5模型被美国政府禁了,他们正在和商务部谈判。亚马逊也报告了漏洞。这起事件可能改变AI监管规则,值得关注。原文稍后读已读值得跟进有用关注 Anthropic