模型多源确认精选

Anthropic 联合三所大学发布 LLM 密码分析基准 CryptanalysisBench

精选理由

Anthropic 和欧洲几所高校搞了个新基准,专门测大模型破解密码的本事,比单纯看推理能力更有针对性。

Anthropic 与苏黎世联邦理工学院、特拉维夫大学和海法大学合作开发了 CryptanalysisBench,这是一个专门评估 LLM 密码分析能力的基准。该基准旨在系统测试模型在经典密码学任务上的表现,例如破解简单加密、识别加密算法等。相关论文已发布在 arXiv (2607.18538)。

图片来源 · Anthropic
原文 · Anthropic

We also worked with academics at ETH Zurich, Tel Aviv University, and the University of Haifa to build CryptanalysisBench, a benchmark for studying LLMs’ cryptanalysis abilities. arxiv.org/abs/2607.18538 💬 12 🔄 7 ❤️ 99 👀 16157 📊 20 ⚡