研究论文
Anthropic 联合三所高校发布 CryptanalysisBench 基准
Anthropic 与 ETH Zurich、特拉维夫大学、海法大学合作,推出用于评估大模型密码分析能力的 Crypta…
2026.07.29 · 周三约 2 分钟阅读
Anthropic 近日在官方 X 账号上披露,已与苏黎世联邦理工学院(ETH Zurich)、特拉维夫大学以及海法大学的学者展开合作,共同构建名为 CryptanalysisBench 的基准测试,用于系统评估大语言模型在密码分析(cryptanalysis)方面的能力表现。
合作机构与研究框架
本次合作的三所学术机构在密码学与人工智能交叉领域均有研究积累:
- 苏黎世联邦理工学院:信息安全与密码学的传统强校;
- 特拉维夫大学:在理论计算机科学与机器学习研究方面活跃;
- 海法大学:长期参与算法与计算相关研究。
三所高校共同与 Anthropic 团队协作,围绕 CryptanalysisBench 的任务设计与评测方法开展研究,旨在为大模型在该方向的能力提供可复现的标准化测量工具。
CryptanalysisBench 的研究价值
密码分析任务要求模型在长程推理、模式识别与符号推演方面具备较强表现,因此常被研究者用作衡量 LLM 高阶推理能力的探针。与此同时,由于密码分析与恶意破解、隐私窃取等安全风险存在潜在关联,相关能力评估对模型安全与对齐研究同样具有参考意义。Anthropic 此次主导构建专项基准,意味着其在能力评测与安全评估两条研究线上同时往前推进。
信息披露与待跟进要点
截至目前,Anthropic 仅以简短形式披露了合作动态与基准名称,完整任务设计、覆盖的密码学场景、所测试的模型范围以及定量成绩尚未在公开渠道释放。后续若随附论文或技术报告一同发布,将对该领域研究者更具参考价值。建议关注 Anthropic 官方渠道以及合作高校的相关页面,以获取详细方法、数据与结论。
