中文翻译

摘要: 4 月,安全公司 Calif 利用 Anthropic 未公开的 Claude Mythos Preview 模型,仅用六天便绕过了苹果 M5 芯片的硬件级内存保护机制,成功构建 macOS 内核利用程序。该事件引发安全界震动,但苹果尚未发布补丁。Anthropic 明确否认 Mythos 将公开,其仅限防御性研究合作使用。ExploitBench 基准测试证实,Mythos 在漏洞利用能力上显著

正文

4 月 25 日,总部位于帕洛阿尔托的安全公司 Calif 的研究人员在 macOS 中发现了两个漏洞。仅六天后,即 5 月 1 日,他们便成功构建出一个可运行的内核利用程序,绕过了苹果为其 M5 芯片投入五年时间和数十亿美元打造的硬件级保护机制——内存完整性强制(Memory Integrity Enforcement)。帮助他们达成这一突破的工具是 Anthropic 的前沿 AI 模型 Claude Mythos Preview。该团队随后在库比蒂诺向苹果当面披露了这一发现,并于 5 月 14 日发布了一篇博客文章,其影响力如同深水炸弹般震撼了整个安全社区。

截至目前,苹果尚未发布修复补丁。

这才是真正值得关注的新闻焦点,而非社交媒体及部分 AI 媒体上流传的"Claude Mythos 即将面向公众开放”的说法。Anthropic 已在其系统卡片、Project Glasswing 项目页面以及多次公开声明中明确表示:Claude Mythos Preview 不会向公众开放。预测市场给出的概率显示,截至 6 月 30 日公开发布的可能性仅为约 7%。“预览标签已移除,公开发布迫在眉睫”的叙事既无任何可信报道支持,也直接与该模型的构建方立场相悖。

事实上,这一事件的真实版本若有任何不同,恐怕比被夸大渲染的版本更为令人担忧。

Claude Mythos 的实际能力:ExploitBench 数据真实可靠

Claude Mythos Preview 是一款真实存在但尚未发布的前沿模型。Anthropic 于 4 月 7 日宣布推出该模型,同时启动了 Project Glasswing 计划,向包括亚马逊云科技(AWS)、苹果、思科(Cisco)、CrowdStrike、谷歌、摩根大通(JPMorgan Chase)、Linux 基金会和微软在内的十二家主要启动合作伙伴,以及四十多家经过严格审核的其他组织提供访问权限,且所有用途仅限于防御性网络安全工作。

引发广泛报道的核心基准测试同样真实且经过同行评审。ExploitBench(arXiv 论文编号 2605.14153)由安全研究员李成勋(Seunghyun Lee)与计算机科学家大卫·布鲁姆利(David Brumley)共同撰写,该研究对九款前沿 AI 模型进行了测试,评估其在 V8 JavaScript 引擎(内嵌于 Chrome、Edge、Node.js 及 Cloudflare Workers)中 41 个已知曾被利用的真实漏洞上的表现。测试结果证实了此前广泛流传的数据:在研究人员偶尔指导下,Mythos Preview 的平均得分为 9.90 分(满分 16 分),并在 41 个测试漏洞中的 21 个上达到了最高层级——实现任意代码执行;而表现次优的 OpenAI GPT-5.5 仅在两个漏洞上达到该层级。在完全自主模式下,差距进一步拉大:Mythos 得分为 9.55,GPT-5.5 则为 4.30。

本周发布的基准测试论文及其作者还确认:运行一次 Mythos 会话的成本约为同等 GPT-5.5 运行的十二倍——这一显著的成本不对称性在多数喧嚣的转述中鲜有提及。

这些数据之所以具有重要意义,关键在于 ExploitBench 的设计思路。以往大多数网络安全基准测试往往将漏洞利用过程简化为二元判断:模型是否导致目标崩溃?而 ExploitBench 则……


来源: Brave/techtimes.com

采集时间: 2026-05-17 20:19:52

AIAnthropicClaude人工智能