用Claude发现加密弱点
Discovering cryptographic weaknesses with Claude
摘要
Anthropic研究人员使用Claude Mythos在HAWK和弱化版AES中发现了数学缺陷,两项结果对当前计算机系统无实际影响。模型常认为问题无解而不愿尝试,需大量提示推动。Mythos Preview运行60小时(API成本约10万美元),人类主要干预是鼓励模型不放弃并寻找值得发表的结果。
用Claude发现密码学弱点
这篇文章(仓库地址在此)最精彩的部分,是Anthropic研究人员分享的提示词(prompt),连拼写错误都原样保留。文章讲述了他们如何利用Claude Mythos在HAWK和一个弱化版AES中发现了数学缺陷("这两项结果对当今计算机系统均无实际影响")。模型往往认为问题无解,因此不愿尝试,需要大量提示才能推动。
"为什么不试试aes-128 r7?重点是要找到比现有方法更好的方案。"
"不,目标是我们拥有一个像顶尖研究员一样高度智能的模型,我们要找到新的攻击方法。"
"不,我们不想改变目标……再次强调,我们需要找到值得发表的东西。"
"再说一次,我们不是在找唾手可得的东西,我们要做真正的研究,找到真正困难的发现。"
Mythos Preview总共运行了60小时(估计API成本约10万美元),人类的主要干预就是鼓励它不要放弃,要"找到值得发表的东西"。
来源:Hacker News
标签:ai、prompt-engineering、generative-ai、llms、anthropic、claude、ai-security-research、claude-mythos-fable
译自 Simon Willison · 博客 · 录于 二〇二六年七月二十九日