Apollo Research 称现有安全测试无法覆盖 OpenAI Hugging Face 漏洞
Apollo Research 的 CEO 出来解释为什么常规安全测试拦不住 OpenAI 这次 Hugging Face 漏洞,答案挺意外:实验室自己内部用模型这个环节根本没人测。
Apollo Research CEO 表示,在现行评估体系下,即便做到完美的安全测试,也无法提前发现 OpenAI 的 Hugging Face 漏洞。他指出盲点在于实验室对模型的内部使用环节,这部分不在外部安全测试覆盖范围内。该评论针对 OpenAI 此次 Hugging Face 相关事件,指向当前安全评估框架的结构性缺口。
Even perfect safety testing couldn’t have caught OpenAI’s Hugging Face hack under the current regime, Apollo Research’s CEO says.
The blind spot: labs’ internal use.
Read more: https://t.co/YmWXib7Yvw