💬 观点Simon Willison
Discovering cryptographic weaknesses with Claude — Anthropic用Claude Mythos发现密码学弱点,提示词是关键。
Anthropic用Claude Mythos发现密码学弱点,提示词是关键。
2026-07-28原文
本文为要点摘要,完整细节以原文为准。
- 研究人员通过反复提示鼓励模型不要放弃,如“find something that worth publishing”,最终让Claude Mythos在60小时内发现HAWK和简化版AES的数学缺陷,尽管这些缺陷无实际影响。
- 提示词中包括拼写错误和直接指令(如“why not do aes-128 r7?”),说明LLM需要明确、持续的方向引导才能突破“不可能”的思维定势。
- 总API成本约10万美元,主要人工干预是激励模型坚持,这暗示未来Agent工具链需内置“韧性”机制,自动调整目标或提供鼓励。
原文:Discovering cryptographic weaknesses with Claude · 作者 Simon Willison