精选理由
哥们,koltregaskes在X上说了个实在话:外面有同等能力的AI了,你的安全护栏不改,危险能力还是存在,只是换个人去防。
一条来自X的推文(用户koltregaskes)指出,当外部出现与你的AI系统相当的能力时,安全护栏必须更新。否则,你并没有从世界中移除危险能力,只是把防御工作推给了愿意承担的人。该观点强调了安全策略的动态性,但没有涉及具体模型或基准。
原文 · @koltregaskes
Once comparable capability exists outside your con…
Once comparable capability exists outside your control, safety guardrails have to evolve. Otherwise, you’re not removing dangerous capability from the world - you’re just pushing legitimate defensive work to whoever’s willing to do it.