行业多源确认

Claude Mythos 从“太危险”到公开可用仅两月

精选理由

AI 安全研究者或关注 AI 伦理的读者会看到 Anthropic 安全声明的矛盾——从“太危险”到公开仅两月,值得反思行业套路。

Anthropic 的 Claude Mythos 模型在两个月内从被认为“太危险无法发布”转变为公开可用,仅增加了额外护栏。评论者 Gary Marcus 指出公众再次被 Anthropic 的套路所迷惑。这一转变引发了对 AI 安全声明可信度的质疑,暗示公司可能利用安全担忧进行营销。事件凸显了 AI 行业在安全与商业化之间的紧张关系。

原文 · Gary Marcus

Claude Mythos went from “too dangerous to release” to publicly available (with some extra guard rails) in two months. And y’all fell for Anthropic’s whole routine. Again. 🤦‍♂️ 💬 6 🔄 7 ❤️ 38 👀 1708 📊 10 ⚡