AI 找漏洞的速度,已经超过了人类修补的速度。据 ProPublica 获得的内部会议录音和文件披露,Anthropic 的新一代 AI 模型 Claude Mythos Preview 在微软代码中发现安全漏洞的速度之快,让这家软件巨头的工程师陷入了一场「疯狂赶工」。这篇调查报道于 7 月 29 日经 Ars Technica 转载发布。

一场内部会议曝光的「赶工令」
今年 5 月中旬的一个下午,数十名微软工程师和管理者在雷德蒙德总部的会议室及线上集合,讨论「玻璃翼计划」(Project Glasswing)——Anthropic 发起的合作项目,向部分关键软件厂商开放 Mythos 模型的使用权限,目标是赶在黑客用上同类工具之前,先把漏洞找出来修掉。
会上有工程师发问:Mythos 的表现配得上 Anthropic 宣传的期待吗?一位管理者的回答很干脆:「配得上。」问题在于,模型挖洞的速度已经超过了微软打补丁的速度。演示文稿中的一页显示,仅今年 4 月,Mythos 就在微软广泛使用的协作软件 SharePoint 中发现了 90 个「严重」级和 141 个「重要」级漏洞;5 月上半月发现的数量还要更多。
工程经理汉斯·安德森在会上恳求同事:「拜托,如果你的团队还有 4 月的漏洞没处理,赶紧压下去。」他解释说,5 月 31 日被视为「世界其他玩家追上来的日子」——一旦同等能力的公开模型问世,对手也能找到同样的漏洞。有工程师当场总结了这个困境:「所以如果 6 月 1 日发布,6 月 2 日对手就掌握我们的漏洞了?」得到的回答是两声干脆的「对」。
补丁数量连破纪录
微软的压力已经反映在公开数据上。每月例行的「补丁星期二」中,6 月微软发布了超过 200 个漏洞的修复补丁,业内专家当时称之为历史新高;结果 7 月 14 日这一纪录就被打破——单月补丁数量超过 600 个,其中仅 7 个属于低危或中危,其余全部为「重要」或「严重」级别,还有一个漏洞正被黑客活跃利用。
「好了各位,漏洞末日已经全面降临。」趋势科技旗下 Zero Day Initiative 漏洞悬赏项目负责人达斯汀·柴尔兹在 7 月 14 日的博客中如此写道。
内部文件还显示,自微软今年启用 Mythos 以来,已在 Microsoft 365、Teams 会议平台和 Copilot AI 工具等热门产品中累计发现数百个严重或重要级漏洞,截至 5 月中旬大部分尚未修复。SharePoint 团队按计划将「忙上好几个月」:先清严重级,8 月处理重要级,之后还有约 300 个中危漏洞排队。
「低危漏洞串起来就是高危」
微软目前的策略是按危险程度分级处置,优先修补严重和重要级漏洞——这也是行业通行的「分诊」模式。但在 AI 挖洞时代,这套策略暗藏风险:Mythos 能把多个漏洞串联成攻击链,几个不起眼的低危缺陷组合起来,破坏力不亚于一个高危漏洞。
「现在的问题是,串联四个低级缺陷,效果可能等于一个高危漏洞,」Anthropic 高级技术顾问、曾任美国国家安全局首席 AI 官的阮荣(Vinh Nguyen)表示,「如果站在微软的角度看,现行分诊策略可能低估了风险。」他认为,企业需要重新思考整个漏洞处置思路,投入人手覆盖全谱系的漏洞,而不是把低危缺陷搁置一旁。
微软在回应中为自己的策略辩护,称分诊决策基于可利用性和客户影响等多重因素,漏洞串联「长期以来都是漏洞评估的一部分」,并表示「安全是微软最重要的优先事项」。但该公司也承认,漏洞总量「短期内不会见顶」。
整个行业的技术债都在到期
这场危机并非微软独有。开源软件同样面临海量 AI 发现的漏洞待修,而它们大多由志愿者维护。「没人真正想清楚该怎么应对,所有人都在摸索。」曾任美国网络安全顾问的 J. 迈克尔·丹尼尔说,「技术债到了还债的时候。」
漏洞管理专家本·爱德华兹的比喻更为形象:「以前是对着开到最大的花园水管喝水,现在是对着消防水枪喝。过去的团队或许应付得了水管,能不能应付消防水枪,就是另一回事了。」