模型与研究

Anthropic 称 Claude 已能发现密码学算法新弱点,HAWK 与 AES 研究都进入更深一层

Anthropic 发布研究称其 Claude Mythos Preview 已能在密码学算法层面发现新弱点,分别对后量子签名候选 HAWK 和减轮 AES 找到更深的攻击路径,但均不影响当前生产系统。公司与多所高校合作推出 CryptanalysisBench,并强调这是负责任披露和安全压力测试的一部分。

Anthropic 称 Claude 已能发现密码学算法新弱点,HAWK 与 AES 研究都进入更深一层

Anthropic 发布研究称其 Claude Mythos Preview 已能在密码学算法层面发现新弱点,分别对后量子签名候选 HAWK 和减轮 AES 找到更深的攻击路径,但均不影响当前生产系统。公司与多所高校合作推出 CryptanalysisBench,并强调这是负责任披露和安全压力测试的一部分。

Anthropic 7 月 28 日发布补充研究《Discovering cryptographic weaknesses with Claude》,称其 Claude Mythos Preview 不再只是帮助研究人员找出软件实现层面的漏洞,而是开始在密码学算法本身上找到新的攻击路径。公司说,最新结果分别针对后量子数字签名候选方案 HAWK 和减轮版 AES,且目前都不影响任何生产系统

Anthropic 把这项工作描述为一次从“代码里找 bug”向“算法里找弱点”的跃迁。官方文章称,Claude 在 HAWK 上把已知最佳攻击进一步推进,并把攻击者需要的“有效密钥强度”大致削弱一半;在 AES 方面,Claude 找到了一种针对 7 轮版本的新方法,速度比此前最佳已知攻击快 200 到 800 倍。公司同时指出,HAWK 仍只是候选签名方案,并未部署到现实系统中,而 AES 研究针对的也不是完整的 10 轮 AES-128。

这次研究具体做了什么

Anthropic 说,HAWK 攻击是在一周左右的时间里,由一名研究人员与 Claude 协作完成,整个发现、开发与验证过程约耗时 60 小时,开发成本大约 10 万美元。第二项 AES 结果则更接近“半自主”流程:研究人员搭建了一个 scaffold,让 Claude 能提出假设、做实验、再验证或推翻自己的结论。Anthropic 还表示,为了让外界继续评估大模型在密码分析上的能力,公司与 ETH Zurich、Tel Aviv University 和 TU Berlin 合作推出了 CryptanalysisBench

在技术意义上,这一变化比“找实现漏洞”更进一步。实现漏洞通常意味着程序员把算法用错了;而算法层面的弱点,意味着研究对象本身可能存在更深的数学缺口。Anthropic 在文中强调,这类工作仍属于“应有的压力测试”,目的不是立即破坏现有系统,而是更早发现问题、推动更强的安全标准。

为什么这件事值得关注

这条新闻的看点,不只是 Claude 找到了两个密码学问题,而是前沿模型开始被放到更接近专家级研究的位置上。Anthropic 说,研究流程大体遵循负责任披露:它在公开前与学术界确认结果,并提前向美国政府和行业伙伴分享副本;针对 HAWK 的结果,公司还在 6 月把攻击方案分享给 HAWK 作者,并在公开发布时同步给了 NIST 相关邮件列表。

这也让 AI 安全的讨论,进一步从“模型会不会生成坏代码”延伸到“模型能不能直接参与安全研究工作流”。这一点与 AI Flux 近日报道的微软推出首款网络安全专用模型,想把漏洞发现和修复变成持续工作流的方向相似:安全能力正被拆成更细的环节,再由模型、工具和人类审查串成连续流程。OpenAI 近期把生物安全漏洞悬赏常态化为长期私密项目的做法,也说明大模型公司越来越把“发现问题”本身,视作产品安全体系的一部分,而不是一次性公关动作。OpenAI 将生物安全漏洞悬赏升级为持续私密项目,GPT‑5.6 成新靶标就是另一种例子。

仍然不是“现实系统被破解”

Anthropic 反复强调,这两项结果都不代表今天的互联网加密系统已经出现可直接利用的风险。HAWK 仍处在候选标准阶段;AES 这项工作只针对减轮版本。公司也提醒,AES 相关攻击在现实部署中并不可行,实施成本会非常高。

不过,真正值得留意的是时间尺度的变化。Anthropic 说,Claude Mythos Preview 过去已经能帮助发现软件库中的实现漏洞,而这次开始能在算法层面找到此前未被识别的数学对称性和攻击思路。若这种能力继续增强,未来争论的重点可能不再只是“模型能否帮忙找漏洞”,而是“人类是否已经来得及验证它找到的下一批结果”。

Anthropic 的完整技术细节分别见 HAWK 论文AES 论文。围绕 Mythos 早期能力边界的讨论,路透社在今年 4 月和 5 月也曾先后报道过相关风险与争议,显示这条路线自发布起就伴随着更大的安全想象空间和监管关注:4 月报道5 月报道

不错过任何一条 AI 大事

订阅 AIFlux 早报,每天 3 分钟看懂产业动态。

相关阅读