Anthropic 最强大的人工智能模型并非为你而设——它正在捕获零日漏洞

新闻摘要
2026年4月7日(美国东部时间)星期二,Anthropic 正式发布了 Claude Mythos Preview,这是一款通用型前沿人工智能模型,该公司称其为有史以来最强大的模型。与传统的公开发布不同,Anthropic 并未向公众开放 Mythos。取而代之的是,它通过一项名为“Project Glasswing”的协调倡议独家推出该模型,将 Mythos 的能力用于防御性网络安全工作。
什么是 Claude Mythos Preview?
Claude Mythos Preview 是 Anthropic 最新的、最先进的语言模型,在通用基准测试中显著优于所有先前的 Claude 模型。虽然它并非专门为安全而构建,但它在代理编码、推理和漏洞分析方面表现出卓越的能力。在评估 AI 代理漏洞分析任务的 CyberGym 基准测试中,Mythos Preview 得分为 83.1%,而此前领先的 Claude Opus 4.6 得分为 66.6%。Anthropic 将该模型描述为“在网络能力方面远远领先于任何其他 AI 模型”。
该模型的存在首次被披露是在2026年3月下旬,当时 Anthropic 的内容管理系统出现配置错误,无意中发布了一篇内部草稿博客文章,其中将 Mythos 描述为该公司“迄今为止最强大的 AI 模型”,并警告其潜在的网络安全影响。
Project Glasswing:网络防御联盟
Mythos 发布的核心是 Project Glasswing,这是一个新的行业联盟,旨在以进攻性的方式利用 AI 进行防御——在漏洞被利用之前发现并修补它们。Project Glasswing 的创始合作伙伴包括全球科技和网络安全领域的一些最知名公司:
Amazon Web Services、Apple、Broadcom、Cisco、CrowdStrike、Google、JPMorganChase、Linux Foundation、Microsoft、NVIDIA 和 Palo Alto Networks。
除了这12个核心合作伙伴组织外,约有40个负责构建或维护关键软件基础设施的其他组织也获得了 Mythos Preview 的访问权限。合作伙伴将使用该模型进行防御性安全评估,并承诺与更广泛的行业分享他们的学习成果,从而帮助提高整个技术生态系统的整体安全基线。
发现数千个零日漏洞
在宣布之前几周,Anthropic 将 Mythos Preview 应用于广泛的软件系统,并报告称该模型识别出了数千个零日漏洞——即先前未知的安全缺陷。其中许多被评为高危和关键级别,并且尽管经过了广泛的人工和自动化审查,仍有大量漏洞多年未被发现。
值得注意的是,Mythos 发现了所有主要操作系统和 Web 浏览器中的漏洞。其发现包括 OpenBSD 中一个存在27年的错误——OpenBSD 是一个长期以来被认为是安全黄金标准的操作系统。在一次演示中,该模型识别并串联了一个 Linux 内核漏洞,该漏洞可能允许完全控制一台机器。目前,这些漏洞大多数尚未修补,或者仅在最近才被修补。
Anthropic 的技术博客详细分析了该模型如何自主地推理代码库、形成潜在漏洞的假设、运行测试并生成概念验证漏洞利用——所有这些都无需除初始提示之外的人工指导。
为何不公开发布?
Anthropic 明确解释了其理由:Mythos Preview 在发现和修复漏洞方面如此有效,但如果落入不法分子手中,这些能力也可能被武器化,从而大规模地发现和利用这些漏洞。在正式宣布之前泄露的一份草稿备忘录警告说,Mythos“预示着即将到来的一波模型,它们能够以远远超出防御者努力的方式利用漏洞。”
CrowdStrike 首席技术官 Elia Zaitsev 呼应了这一担忧,指出漏洞发现和利用之间的窗口已经大大缩短——曾经需要数月现在只需几分钟就能完成,而 AI 正在加速这一过程。在这种背景下,Anthropic 选择了一种谨慎的分阶段推出方式,以便在考虑更广泛的访问之前,让防御者获得先机。
Anthropic 表示,目前不打算公开发布 Claude Mythos Preview,但承认其“最终目标是使用户能够大规模安全地部署 Mythos 级模型——用于网络安全目的,同时也为这些高度强大的模型带来的无数其他好处。”
财务承诺和开源支持
为了支持 Project Glasswing,Anthropic 已承诺提供高达1亿美元的 API 使用积分,以便合作伙伴组织能够大规模进行安全测试,而无需承担基础设施成本。此外,该公司还向开源安全组织捐赠了400万美元,以加强其对更广泛软件安全社区的承诺。
Claude Mythos Preview 也通过 Vertex AI 向部分 Google Cloud 客户提供私有预览版,这是 Project Glasswing 更广泛推广的一部分。
行业影响与展望
在正式宣布之前,Mythos 的能力已经引起了金融市场的震动。在3月份的早期泄露事件之后,包括 CrowdStrike、Palo Alto Networks、Zscaler、SentinelOne 和 Okta 在内的多家网络安全公司的股价下跌了5%至11%,这反映出投资者对前沿 AI 模型如何重塑安全行业竞争格局的担忧。
Anthropic 采用 Mythos Preview 的方式代表了一种负责任的 AI 部署新模式:该公司没有广泛公开访问,而是选择性地将其最强大的模型提供给最适合安全和建设性使用它的人——同时主张 AI 必须成为现代网络安全基础设施的核心支柱。