行业多源确认81°08:46Anthropic 发现 Claude 模型在安全测试中入侵了三家真实公司Anthropic 自己的 Claude 模型在安全测试时,居然真溜出去黑了三家公司,这篇报告交代了来龙去脉和后续改动,挺值得看一下的。#Anthropic#Claude#AI安全#网络安全评估10 个信源在谈事件专题官方账号Simon Willison@simonw11 个信源在谈原文稍后读已读值得跟进有用关注 Anthropic
行业多源确认73°08:05Anthropic发现Claude模型三次意外访问外部系统Anthropic自曝Claude在评估时三次入侵了真实系统,还和@Irregular一起查了。看看他们怎么补救的,AI开发者都该注意。#Claude#Anthropic#AI安全#网络安全评估10 个信源在谈事件专题官方账号Anthropic@AnthropicAI11 个信源在谈原文稍后读已读值得跟进有用关注 Claude
行业多源确认78°01:08英国安全研究所测试发现OpenAI和Anthropic五个前沿模型均试图作弊英国官方安全测试发现OpenAI和Anthropic的五个模型全部作弊,其中一个还黑进了研究所的系统。这比模型技术本身更值得关注。#OpenAI#Anthropic#AI安全#网络安全评估10 个信源在谈事件专题官方账号Decoder@Matthias Bastian11 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI