Anthropic 于 5 月 22 日发布 Project Glasswing 一个月阶段性报告,首次正式披露内部前沿模型 Claude Mythos Preview 的安全能力表现。项目自上月启动以来,Anthropic 与约 50 家合作伙伴共同使用 Mythos Preview 扫描关键基础软件,合计已发现逾 1 万个高危或严重级别漏洞,多数合作伙伴的漏洞发现速率较以往提升超 10 倍。具体案例包括:Cloudflare 在关键路径系统中发现 2000 个漏洞(其中 400 个高危/严重),误报率优于人工测试;Mozilla 在 Firefox 150 中发现 271 个漏洞,为使用 Claude Opus 4.6 测试 Firefox 148 时的 10 倍以上;英国 AI 安全研究所(AISI)证实,Mythos Preview 是首个端到端完成其两套网络攻击仿真范围的模型;Mythos Preview 还协助一家合作伙伴银行识别并阻止了一笔 150 万美元的欺诈性电汇。
在 Anthropic 独立主导的开源软件扫描中,1000 余个项目共被发现约 2.3 万个潜在漏洞,其中 6202 个被估计为高危或严重级别;经独立安全机构核实的样本显示,90.6% 为真阳性,62.4% 确认为高危或严重,预计最终核实数量将逼近 3900 个;已公开的案例包括 wolfSSL 加密库的证书伪造漏洞(CVE-2026-5194)。报告指出,当前最大瓶颈已从"发现漏洞"转移至"修复漏洞"——开源维护者严重超负荷,部分甚至主动要求 Anthropic 放慢披露节奏,高危漏洞从披露到修补平均耗时两周;微软和 Palo Alto Networks 的补丁数量已大幅激增。Anthropic 警告,“具备同等网络安全能力的模型很快将更广泛地可用”,并就防御方如何适应这一新阶段提出了建议,同时披露了 Mythos 级别模型未来公开发布的路线图思考。