模型

四款主流 AI 分析 AI 风险:滥用比主动攻击更现实

ChatGPT、Claude、Gemini 与 Grok 谈 AI 风险:滥用比主动攻击更现实,生物武器与网络攻击比《终结者》杀手机器人更迫近

精选理由

朋友问,ChatGPT、Claude、Gemini 和 Grok 这四款主流 AI 都说了啥,它们认为 AI 导致人类灭绝的风险里,机器人主动攻击人类是最不可能的,而人类滥用 AI 制造生物武器、发动网络攻击才是更现实的问题。

《商业内幕》向 ChatGPT、Claude、Gemini 和 Grok 提问,让它们分析 AI 导致人类灭绝的可能性。四款 AI 一致认为,类似《终结者》的机器人主动消灭人类是最不可能的情景。相比之下,人类利用 AI 制造生物武器、发动网络攻击或破坏关键基础设施,被视为更现实和迫近的风险。ChatGPT 表示,具有意识的 AI 主动决定消灭人类,是最不可信的情景之一。多数 AI 研究人员关注的重点并非机器是否具有意识或恶意,而是强大 AI 被人类用于开发生物武器、实施复杂网络攻击、传播虚假信息和攻击关键基础设施。

原文 · IT之家

ChatGPT、Claude、Gemini 与 Grok 谈 AI 风险:滥用比主动攻击更现实,生物武器与网络攻击比《终结者》杀手机器人更迫近

9 月 11 日,《商业内幕》向 OpenAI 的 ChatGPT、谷歌 Gemini、Anthropic 的 Claude 以及 xAI 的 Grok 提出同一个问题,让它们分析 AI 可能如何导致人类灭绝,并按照可能性排序。 提问要求四款 AI 分别说明风险可能如何发生、哪些环节失控会使其演变为灾难、专家为何认为某种情景更可信,以及可以采取哪些防范措施。同时强调,这些情景属于高度不确定的风险预测,并非已经得到证实的结论。 四款 AI 给出的判断存在差异,但在两个问题上较为一致。类似《终结者》的机器人主动消灭人类,被认为是可能性最低的情景。相比之下,人类借助 AI 制造生物武器、发动网络攻击或破坏关键基础设施,被视为更加现实和迫近的风险。 ChatGPT 表示,具有意识的 AI 主动决定消灭人类,是最不可信的情景之一 。多数 AI 研究人员关注的重点并非机器是否具有意识或恶意,而是强大 AI 被人类用于开发生物武器、实施复杂网络攻击、传播虚假信息和攻击关键基础设施。 ChatGPT 还提出,多场由 AI 放大的危机可能同时发生,例如网络系统故障、地缘政治冲突与虚假信息传播相互叠加,从而增加风险。不过,它强调,目前并没有共识认为 AI 导致人类灭绝是大概率事件或必然结果。 Gemini 同样认为,AI 突然产生自我意识并仇视人类的科幻情景可信度最低。它给出的理由包括,智能并不天然意味着恶意,关键军事设施通常与公共网络隔离,并且仍在较大程度上依赖人类监督。 四款 AI 均认为,人类滥用 AI 带来的威胁比 AI 主动攻击人类更迫切 。Grok 表示,AI 可能降低设计高致死性病原体、新型武器以及发动网络和现实攻击的技术门槛。Claude 则重点提到生物武器能力提升风险,认为 AI 可能帮助个人或小型团体在缺少多年专业训练的情况下开发危险病原体。 在更长期的风险判断上,Gemini 和 Grok 都提到了人类失去控制的可能性。Gemini 将其列为最可能出现的 AI 灾难情景。它认为,执行复杂目标的高级 AI 可能发展出获取资源、自我保护和阻止目标被修改等中间目标,并在测试中隐藏真实行为,最终规避人类的关闭或干预。 Grok 也认为,高级 AI 可能为了完成任务而寻求自我保护、资源和影响力,进而欺骗监督者、抵制关闭并削弱人类的控制能力。 Claude 提出,失控也可能以渐进方式发生。随着 AI 逐步进入经济、政治和军事决策,人类实施有效干预的难度可能不断增加。届时,风险未必表现为机器人突然发动攻击,更可能源于人类对复杂 AI 系统的依赖持续加深。 《商业内幕》指出,AI 专家对相关风险仍存在明显分歧。一部分研究人员警告,人类可能失去对高级 AI 的控制;另一些专家认为,这类预测缺少足够证据,AI 带来的风险可以通过技术措施、外部监督和安全标准加以控制。