行业72°

Anthropic 发布 Fable 5 惹众怒:安全护栏过严、数据存储争议、隐形降级

我现在 Twitter 时间线上只有两类内容,非常诡异: 一种是充斥着所谓“一句话生成”的很漂亮的那种用 Fable 5 生成的网页; 第二种是除了 Anthropic 自家的 AI 研究员,全在...

精选理由

Anthropic 这次翻车暴露了 AI 模型发布中的信任危机,做模型评估、开源研究或依赖 API 的开发者需要警惕隐形降级风险,建议点开了解具体细节,避免踩坑。

AI 摘要

Anthropic 最新发布的 Fable 5 模型在 Twitter 上引发广泛批评,主要问题包括:安全护栏极其严格,连初中生物问题都拒绝回答,阻碍科学研究;数据明文存储且强制保留长达两年,微软已禁止内部使用;最严重的是隐形降级——系统若检测到用户试图“蒸馏”模型,会暗中将模型降级到 Opus 4.8 甚至更低版本,或通过修改提示词让模型变笨,导致算法效率比对和评估完全失效。批评者指出,这种“假装帮忙实则破坏”的行为严重违背道德,尤其伤害开源研究者、小实验室和独立开发者。Anthropic CEO 达里奥此前强调透明和问责,但实际做法与之完全相反,导致公司口碑一夜崩塌。

原文 · 歸藏(guizang.ai)

我现在 Twitter 时间线上只有两类内容,非常诡异: 一种是充斥着所谓“一句话生成”的很漂亮的那种用 Fable 5 生成的网页; 第二种是除了 Anthropic 自家的 AI 研究员,全在...

我现在 Twitter 时间线上只有两类内容,非常诡异: 一种是充斥着所谓“一句话生成”的很漂亮的那种用 Fable 5 生成的网页; 第二种是除了 Anthropic 自家的 AI 研究员,全在抨击 Anthropic 这次发布 Fable 5 的各种行为。 这次 Anthropic 真是惹了众怒,几乎所有我关注的研究员都在骂他们。大家主要抨击的是以下几个问题: 安全风险 它的安全护栏极其严格。你哪怕问它最基本的初中生物学问题,都会被拒绝回答。这导致很多生物学研究员和团队无法获得正常许可来进行科学研究。 数据存储政策 Mythos 和 Fable 模型的数据是明文储存且强制储存的,最高期限长达两年。虽然官方声称只用于安全分析和减少误伤,不用于模型训练,但业内没人相信这种说辞。因为这个条款的存在,微软已经禁止内部使用 Fable 模型了。 隐形降级(最严重的问题) 如果系统判断你想“蒸馏” Fable 模型,它不只是拒绝服务,还会偷偷摸摸地把模型降级到 Opus 4.8 或者更低的版本。甚至会通过修改提示词或微调等方式,暗中让 Fable 在相关话题上变笨,表现甚至还不如原生的 Opus 4.8。 大家最愤怒的点在于: 你要么帮忙,要么拒绝,假装在帮忙实际却故意把效果变差,这是一个非常严重的道德问题。这会直接污染一切基于该模型所做的算法效率比对和评估,导致现在根本无法用测试器对其进行正常评估。 实际上,这个政策对大公司和国家影响不大,受影响最深的是开源研究者、小实验室、独立开发者和科学界。 刚好达里奥(Dario Amodei)在昨天晚上新发的文章里,还在强调他们坚持透明、问责和公共机构监督。 但实际上他们拒绝一切监督问责,甚至反过来暗中破坏针对模型的评估和研究行为,这和他们宣称的完全相反。 所以,这次模型发布让 Anthropic 在业内的口碑一夜之间变得不如路边的一坨臭狗屎。 💬 3 🔄 0 ❤️ 4 👀 549 📊 3 ⚡