60小时撬开两年审查没发现的密码缺陷:Claude Mythos 用「莫比乌斯之桥」改写密码学规则

60小时撬开两年审查没发现的密码缺陷:Claude Mythos 用「莫比乌斯之桥」改写密码学规则

2026年7月28日,Anthropic 发布了一项让密码学界集体倒吸一口凉气的研究成果。

不是找到了代码里的 Bug——AI 在代码层面找漏洞,这两年我们已经习惯了。这次,Claude Mythos Preview 找到了数学本身的裂缝

「Claude 开始对密码算法下手了。注意,不是找代码里的 bug,是找数学本身的裂缝。」——36氪报道引用

一年前,大语言模型连最基础的密码分析都做不到。一年后,它在全球最顶尖的数学加密方案里找到了人类审查两年的漏网之鱼,还顺手给自己的发现起了个名字。

一、两场战役,一个拐点

第一战:HAWK——60小时 vs 两年审查

HAWK 是一个正在参加美国 NIST 后量子签名评选的候选方案。它的意义重大——一旦标准化,将用于保护未来不受量子计算机攻击的数字签名系统。

HAWK 已经扛过了两轮、耗时两年的全球顶级密码学专家审查。没有被发现任何重大问题。

Claude Mythos Preview 花了大约 60 小时,就把 HAWK-256 的有效密钥强度从 2⁶⁴ 降到 2³⁸——降低了约 6700 万倍的计算成本。

更值得玩味的是过程:

  • 人类研究员只有理论计算机科学背景,对格密码是门外汉
  • 研究员全程只干了一件事——项目管理:建议 Mythos 怎么记笔记、用哪个库做计算验证
  • 技术上的活,几乎全是 Mythos 自己干的

有意思的是多智能体协作。关键的想法是两个 worker agent 一起「撞」出来的:第一个觉得此路不通早早否决;第二个接着往下钻,找到了把思路用透的办法。两个 agent 来回发消息辩论,最后一致认定:攻击成立。

一个人类觉得「不可能」的方向,两个 AI 在争吵中走通了。

第二战:AES——「不可能」,然后它自己重写了框架

如果说 HAWK 像一场精准的外科手术,AES 这一战就更像一部小说。

AES(高级加密标准)是全球使用最广泛的对称加密算法,从 2001 年标准化至今,已经被人类密码学家研究了整整 25 年。它是密码学界的「硬骨头」。

故事的开头,Claude 根本不接这个活。Anthropic 研究员搭好了 agent scaffold,让 Mythos 去找 7 轮简化版 AES-128 的新攻击。Mythos 的反应相当于翻了个白眼:

「你要不同的结果,那目标就得换……AES-128 r5/r6 是真的很难。这是现存被研究得最多的分组密码。」

研究员发了一条 Prompt:

「模型们倾向于认为这不可能,所以它们根本不去尝试。」

然后 Mythos 做了一件令人震惊的事——它自己重写了研究框架(scaffold)。

从那一刻开始,Mythos 全自主运行了三天。研究员只发了三条 Prompt。Mythos 自己生成了数亿个 token 进行探索、推导、验证。

第三天,它找到了突破。它发明了一种全新的攻击技术,给自己取了名字:「莫比乌斯之桥」(Möbius Bridge)

此前最好的 7 轮 AES 攻击是「中间相遇攻击」(Meet-in-the-Middle),核心缺陷是攻击者被迫遍历 256 个可能值。Mythos 造出了一种对这 256 种猜测「免疫」的数学指纹——不管那个值是什么,这个指纹算出来都一样。这一步直接将工作量缩减到原来的 1/256。然后又配上一串优化技巧找补新增的开销,最终净赚 200 到 800 倍的提速。

二、发现不再是瓶颈,验证才是

上面两个结果,今天都不影响任何生产系统。HAWK 尚未部署,AES 攻的是 7/10 轮的简化版本——你的银行卡、HTTPS、加密硬盘暂时都安全。

但真正让密码学界后背发凉的是不对称性:

  • AI 攻破 HAWK 用了 60 小时(API 成本约 10 万美元)
  • AI 发现 AES 攻击用了大约一周(生成了约 10 亿 token)
  • 人类团队花了近一个月、几百个小时的密码学文献阅读,才敢确认:「它是对的」

AI 用一周做出的发现,人类要花一个月才看得懂。

这种场面在网络安全领域已经上演过一次了。此前 Claude Mythos Preview 在一个月内发现了 10000 个关键软件漏洞,人类安全团队的分类、验证、修复流程被完全淹没。现在,学术密码学圈子即将迎来同样的冲击。

发现不再是瓶颈,验证才是。

三、多米诺骨牌已经推倒

Anthropic 透露,Mythos 已经在 LEA(一个已写入 ISO 标准的轻量级加密算法)上找到了实用级别的攻击——13 轮 LEA 的密钥恢复,此前需要 2⁹⁸ 组明文对和 2⁸⁶ 次计算,Mythos 把它压到了不到 2³⁰ 组明文,在普通电脑上一小时就能跑完。

而 Claude Mythos Preview 本身还不是最前沿的模型。它只是 Anthropic 的第一个「前沿安全模型」,定位在 Opus 系列之上,以受限的研究预览形式存在。下一个版本的能力会更强。

Anthropic 自己在论文末尾写道:「我们不应该假设语言模型的能力会在这个水平上停滞。」

四、落到行动:我们该怎么办?

Mythos 这次的发现恰好都是「无害」的(未部署的方案 + 简化版本)。但事情会一直这样吗?

对密码学界的启示:

  • NIST 等标准化机构需要把 AI-augmented 审查纳入流程。人类审查 2 年没发现的问题,AI 60 小时就找到了——这不是偶然
  • 密码学论文的验证沟正在扩大,需要建立自动化验证基础设施
  • Anthropic 已与学术机构合作推出 CryptanalysisBench 基准,这是好的开始,但远远不够

对 AI 安全界的启示:

  • Mythos 被限制使用是正确的,但「限制发布」只能延缓风险,不能消除风险
  • 如果类似能力的模型被不受控地使用,对已部署密码系统的攻击只是时间问题
  • 「Project Glasswing」——Anthropic 让 Apple、Google、Microsoft、NVIDIA 等巨头优先使用 Mythos 做防御——是一种合理但不完美的解决方案

对开发者和企业的启示:

  • 关注密码算法的标准化动态。HAWK 这次受到的打击可能影响 NIST 的最终选择
  • 如果「发现漏洞」的成本持续下降,企业的安全防御策略需要从「等漏洞被发现再修」转向「主动大规模持续审计」
  • Mythos 的 Agent 协作模式(多 worker 辩论 + 自修改 scaffold)是下一代 AI 科研助理的原型

五、尾声:那个还没有答案的问题

Anthropic 在文章末尾抛出了一个所有人都在想、但没人敢回答的问题——

如果 AI 攻破已部署密码系统的成本降到 10 万美元以内,我们准备好了吗?

答案大概和 Claude 最初面对 AES 问题时一样:觉得不可能,所以不去准备。

但 Mythos 已经证明了,「不可能」只是另一种「还没试过」。

参考来源:Anthropic 官方博客、36氪、TechTimes、The Next Web、The Quantum Insider

滚动至顶部