主要来源Simon Willison’s Weblog
查看原文事件专题 · 多源确认
Anthropic用Claude Mythos发现HAWK和弱AES的数学缺陷
Anthropic研究人员使用Claude Mythos在60小时内发现了HAWK和弱版AES(AES-128 r7)的数学弱点,但两者对当前系统无实际影响。研究花费约10万美元API费用,关键干预是反复用自然语言提示模型“找点值得发表的东西”。研究人员公开了带拼写错误的prompt,例如“no again the goal is that we have highly inteligent model as good top researcher”。实验表明,即使强大模型也需要明确引导才能坚持解决困难问题。
当前结论
Anthropic花了10万刀让Claude跑60小时,逼它找出HAWK和弱AES的数学漏洞,还公开了怎么给模型打鸡血的prompt,很有参考价值。
11 个信源78° AI 热度最后更新 2026/7/28 22:45:37
证据链
相关来源 1向阳乔木
查看原文相关来源 2Decoder
查看原文相关来源 3Lenny Rachitsky
查看原文相关来源 4IT之家
查看原文相关来源 5Anthropic
查看原文相关来源 6AI Breakfast
查看原文相关来源 7Amjad Masad
查看原文相关来源 8Y Combinator
查看原文相关来源 9elvis
查看原文相关来源 10SuperTechFans
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。