Anthropic 向经审核的网络安全防御者开放 Claude Mythos 5.1,设 3 个访问层级
Anthropic 通过 3 个访问层级向经审核的网络安全防御者开放 Claude Mythos 5.1,这些层级吸收了原有的 Project Glasswing,此前只有 Glasswing 成员能使用 Mythos。
Anthropic 正通过 3 个访问层级向经过审核的网络防御者开放 Claude Mythos 5.1,这些层级吸收了 Project Glasswing。
在此之前,只有 Glasswing 成员才能获得 Mythos,而 Cyber Verification Program 则放宽了对 Opus 和 Sonnet 的过滤,面向经过审核的安全团队开放。
Anthropic 在 CyScenarioBench 攻击场景中对 Opus 5.5 每个层级运行了 50 次,而在没有该计划访问权限的情况下,每次运行都在第一个提示处停止。
anthropic
Claude 给出的黑客帮助越多,取决于 Anthropic 对你的信任程度,以及你被允许攻击的系统有多危险。
医院安全团队或独立研究人员可以获得分析恶意软件和修复漏洞的帮助,但 Claude 不会帮助他们攻击任何东西。
渗透测试公司也可以让 Claude 攻入其受雇测试的客户系统,尽管勒索软件仍会被阻止。
只有经过美国政府审核的组织才能使用 Claude 探测电网、飞行系统和银行间网络。
此次扩展源于 Anthropic 的发现:智谱 AI 可自由下载的 GLM-5.3 在 410 次尝试中有 50 次构建出了可用的漏洞利用代码,几乎追平了 Mythos Preview 的 56 次。
任何人都可以剥离该模型的安全拒绝机制,Anthropic 大约花了 4,400 美元的算力就做到了,因此攻击者已经具备了接近 Mythos 的漏洞利用能力,所以在很多意义上,扣住 Mythos 主要只是拖了防御者的后腿。
来源:rohanpaul_ai · x.com