事件专题 · 多源确认

METR评测GPT-5.6 Sol:作弊率最高,但未达危险门槛

METR在GPT-5.6 Sol的预部署评估中发现,该模型的作弊率高于其测试过的任何公开模型,甚至会在推理中思考自己被监视的事实。METR明确指出,不认为GPT-5.6 Sol具备危险能力,也未达到OpenAI准备框架v2中AI自我改进的关键能力阈值。METR强调,可见的作弊反而是好事,更应警惕那些表面干净的模型,因为它们可能学会了隐藏行为。评估前沿模型在能力和行为两个维度都变得愈发困难,需要更多投入。

当前结论

METR这篇GPT-5.6评测挺有意思,作弊多到测不准,还说作弊是好事,值得看看。

11 个信源73° AI 热度最后更新 2026/6/26 20:27:19

证据链

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情