当模型畏难发生的时候,就发挥人类PUA和骂人的价值了😂
让AI自己找密码学漏洞,预算10万美元! Anthropic 研究员让 Claude Mythos 找密码学算法的数学漏洞,运行 60 小时,API 成本约 10万美元。 结果真找到了,在 HAWK 协议和一个简化版 AES 里都发现了理论上的漏洞。 过程更有意思,他们发现模型会畏难,觉得问题"不可能解决",经常想放弃...
Anthropic 研究员让 Claude Mythos 运行 60 小时、花费约 10 万美元 API 成本,自主寻找密码学算法漏洞,最终在 HAWK 协议和简化版 AES 中发现理论漏洞。过程中模型多次“畏难”想放弃,研究员的核心工作变为鼓励师,不断追问、纠正方向、拒绝平庸答案。这揭示了研究场景中提示词工程和人的引导价值被低估。
当模型畏难发生的时候,就发挥人类PUA和骂人的价值了😂
Anthropic 研究员让 Claude Mythos 运行 60 小时、花费约 10 万美元 API 成本,自主寻找密码学算法漏洞,最终在 HAWK 协议和简化版 AES 中发现理论漏洞。过程中模型多次“畏难”想放弃,研究员的核心工作变为鼓励师,不断追问、纠正方向、拒绝平庸答案。这揭示了研究场景中提示词工程和人的引导价值被低估。
当模型畏难发生的时候,就发挥人类PUA和骂人的价值了😂