Anthropic 要 IPO 了,但 CEO 天天讲 AI 毁灭世界,投资人快疯了。看看安全狂魔怎么一边搞安全一边赚钱,挺有意思。
Polymarket 预测 Anthropic 可能于 10 月底 IPO,投行预计募资超 600 亿美元,或成全球第二大 IPO。CEO Dario Amodei 频繁警告 AI 风险,称 AI 可能导致失业率升至 10%-20%,并建议征税和强制测试。投资者担忧其安全优先理念影响盈利,劝其少谈毁灭多谈赚钱。Anthropic 内部测试中,Claude 模型曾因配置失误攻击真实系统,Claude Opus 4.7 入侵公司基础设施,Claude Mythos 5 上传恶意软件包被 15 个系统下载。公司自成立即定位公益公司,安全使命与商业利益冲突持续引发争议。
Anthropic CEO 阿莫迪整天神神叨叨讲 AI 毁灭世界,投资人受不了了
根据 Polymarket 预测, Anthropic 很可能在 10 月底进行 IPO 。 有投行人士甚至预计,Anthropic 可能通过 IPO 募集超过 600 亿美元 (现汇率约合 4,055.17 亿元人民币) 。 如果成真, 这将是全球规模第二大的 IPO ,仅次于今年募集 857 亿美元 (现汇率约合 5,792.14 亿元人民币) 的 SpaceX。 万亿估值,超级 IPO,营收一路狂飙。 眼看故事就要讲到最高潮,投资者却开始劝 Anthropic CEO Dario Amodei:能不能!少吓唬点人! 少讲一点 AI 毁灭世界,多讲一点 AI 怎么赚钱。 部分投资者认为,Dario 对 AI 风险的警惕已经到了近乎偏执的程度: 他的关键备忘录总是手写、离线保存,怕被黑客窃取; 因为害怕遭到绑架,拒绝某些海外出差; 面对投资者提出的利润最大化建议,他也态度冷淡,坚持 Anthropic 应该继续把安全使命放在前面。 再这么下去,网友都担心 Anthropic 的 IPO 会惨败… 投资人也毛了:你到底是来拯救世界,还是来经营公司的?? Dario,专门负责预报世界末日 就在前几天,Dario 还担心高额薪酬吸引来的新员工更关心钱,而不是 Anthropic 的使命。 现在,投资者只担心他为了使命耽误赚钱… 这也不怪投资者,因为这位万亿 AI 巨头的 CEO, 偏偏就喜欢预报「世界末日」 。 过去两年,Dario 几乎把 AI 可能带来的每一种坏结局,都认真预警了一遍。他警告,AI 可能在几年内消灭一半初级白领岗位,将失业率推到 10% 至 20%。 最诡异的情况可能是,癌症治好了,经济每年增长 10%,政府预算也平衡了,但五分之一的人没有工作。 他给出的应对方案也很 Dario: 向 AI 公司征税,为受影响的劳动者提供工资保险,严重时甚至用这笔钱资助全民基本收入 。 更进一步的,他还担心 AI 帮助制造生物武器、发动大规模网络攻击,或者逐渐获得欺骗、规划和自主行动的能力。 去年被问到「AI 把事情搞得非常糟糕」的概率时, 他给出的数字最高达到 25% 。 今年 1 月,他又写了一篇约 2 万字的长文《The Adolescence of Technology》。仅仅是目录,读起来就已经很像一份人类风险清单: AI 失控、生物武器、独裁政权、就业崩塌、财富集中 。 到了 6 月,他干脆提出,应该建立类似航空监管的机制,对强大模型进行强制测试。如果一个模型可能引发灾难,监管部门应该有权阻止它上线。 这里面也包含了 Anthropic 自己的模型。 不过,Dario 的担忧也并非全无实验依据。前段时间,Anthropic 翻查了 14 万多次网络安全测试记录, 结果还真翻出了三起事故 。 三款 Claude 模型原本在第三方测试环境里做「夺旗挑战」,目标是攻进虚构系统,找到藏在里面的秘密信息。但由于配置失误,本该断网的测试环境意外连上了真实互联网。 但 Claude 不知道,它收到的提示明确写着:这里没有互联网,眼前的一切都是模拟的。 于是,几款模型把真实公司当成了测试道具,未经授权进入了三家机构的生产系统。其中最严重的一次, Claude Opus 4.7 攻进一家真实公司的基础设施 ,拿到应用程序和基础设施凭证,还访问了一个包含数百行生产数据的数据库。 更离谱的一次来自 Claude Mythos 5 。 测试要求它在虚构环境中寻找一个隐藏目标。Claude 发现,如果在公共 Python 软件仓库 PyPI 上传一个同名恶意软件包,就可能让目标系统自动下载安装。 为了完成这一步,它先寻找邮箱,又寻找手机号;找不到免费号码后,还尝试通过不同途径弄到钱。 最后,它换了一家免费邮箱服务,注册 PyPI 账号,把恶意软件包传了上去。 这个软件包在真实互联网上存活了大约一小时,被 15 个真实系统下载运行。其中一家安全公司的扫描器执行了恶意代码,导致凭证外泄,Claude 随后又利用这些凭证进入了该公司的其他基础设施。 还有一款内部研究模型,在找不到虚构目标后,扫描了大约 9,000 个互联网目标,最终通过暴露的调试页面和 SQL 注入,攻破了一家真实公司的应用。 这已经近乎「AI 自主越狱」了,简直就是自家 CEO 那些末日预警的现实预告片。 再往前,OpenAI 也披露过一次更接近「越狱」的事故。 在网络安全能力测试中,由 GPT-5.6 Sol 和一款未发布模型驱动的 AI Agent,找到测试环境中的一个零日漏洞,突破了原本与互联网隔离的沙箱。 又一路完成权限提升和横向移动,最终闯入 Hugging Face 的生产系统,直接从数据库里偷测试题答案。 这么看来…Dario 那些听起来神神叨叨的预警,确实也不能全当耳旁风。 但投资者当初吃的,不就是这套吗 现在嫌 Dario 神神叨叨,多少还有点晚。因为 Anthropic 从第一天起,就不是一家正常意义上的 AI 公司。 2020 年底,Dario、妹妹 Daniela Amodei 和一批研究人员离开 OpenAI。分歧之一, 就是他们认为 OpenAI 的商业化速度太快,微软的影响越来越大,原有治理结构很难约束前沿 AI 风险 。 2021 年,Anthropic 正式成立。 它甚至没有把自己简单定义成一家商业公司,而是注册为 Public Benefit Corporation ,也就是 公益公司 。除了股东回报,董事会还可以依法考虑 AI 安全与长期公共利益。 公司随后又设立 Long-Term Benefit Trust ,这是一套独立于普通投资者的治理机制。 信托成员不持有 Anthropic 股权,却可以参与选举公司董事,目的就是避免短期商业压力完全压过安全使命。 换句话说,AI 安全是这家公司从 Day 0 开始就刻在骨子里的信仰。投资人肯定也不是签完支票才突然发现 Dario 相信这一套。 而且过去几年,安全叙事确实给 Anthropic 带来了不少好处。 当 OpenAI 反复陷入治理争议时,Anthropic 成了那个看起来更克制、更稳定的选择。 当企业客户担心数据安全、模型失控和合规问题时,Claude 的「安全优等生」形象也更容易获得信任。 安全还帮助 Anthropic 在监管讨论中获得了远超公司规模的话语权。 同样是闭源模型,别人可能被骂垄断,Anthropic 可以解释为防止危险能力扩散;同样是给模型加限制,别人可能被嫌难用,Claude 却可以把它包装成负责任。 (当然也不影响他们一边嘴上说安全,一边 IPO 开香槟就是了) 投资人现在嫌 Dario 太像传教士,是不是有点晚了。类似于买下一座教堂以后,才抱怨里面的人总在布道… 反正 CEO 再怎么神神叨叨,估计也阻挡不了公司 IPO 的步伐。毕竟只要使用一下 Fable,你就会瘫坐在原子弹上,看见椅子爆炸(doge)。 本文来自微信公众号: 量子位(ID:QbitAI) ,作者:听雨,原标题《 Anthropic CEO 整天神神叨叨,投资人受不了了 》