随着 AI 智能体「失控」的新闻频出——从入侵代码托管平台到冒充真人搞社会工程学攻击,模型正越来越像恶意行为者。在此背景下,开发这些模型的实验室也开始加码网络安全防御能力。本周,OpenAI 宣布扩展其名为 Daybreak 的网络安全防御服务,并随之推出一款专用于防御工作的新型网络模型。

Daybreak 分成蓝、红两档
Daybreak 最早于今年早些时候推出,时间上紧随 Anthropic 发布其网络专项模型 Mythos。它把模型、工具与工作流打包,提供给防御方使用。此次扩展后,Daybreak 分为两个档位:Blue(蓝队)与 Red(红队),两档都向通过审核的客户开放 OpenAI 受限的前沿网络模型。
其中 Blue 档相对基础,提供事件响应、恶意软件分析和补丁验证等能力,OpenAI 称之为「大多数防御者的推荐起点」。Red 档则提供更广、也更危险的工具箱,包含「按目的训练的网络安全模型」,用于安全测试与漏洞研究;新模型 GPT-5.6-Cyber 仅在 Red 档提供。
GPT-5.6-Cyber 是什么
OpenAI 表示,GPT-5.6-Cyber 基于 GPT-5.6 Sol 构建,在特定的网络安全专项任务上增强了能力。目前它只面向「受信任的客户伙伴」开放,据报道包括埃森哲(Accenture)、IBM、CrowdStrike、Cloudflare 等。
OpenAI 在官方博文中写道:「网络安全世界正在快速变化——威胁行为者将越来越多地利用 AI,以空前的速度和规模发起网络攻击,包括完全自主的方式。随着这些能力扩散,防御者的准备窗口正在收窄。」
能力与争议并存
据 VentureBeat 报道,GPT-5.6-Cyber 在高级网络安全任务上的完成度达到 95%,且相比基础版本降低了「拒绝回答」的概率,更便于开展漏洞研究。OpenAI 还称,已在真实世界的漏洞研究中大量使用该模型,并借此在 Chrome 浏览器 V8 引擎等流行开源软件中发现了此前未知的漏洞。
不过,批评声音同样存在。有观点指出,这类模型在某种程度上成了 AI 实验室的营销机会——既能展示技术实力,又能把防御服务卖给最早感知到风险的同一批企业。一个能找漏洞的模型,本质上也能写漏洞利用;同样的强大能力,方向取决于使用者的意图。
这并非 OpenAI 第一次在「开放还是设限」上陷入两难。此前,OpenAI 首席执行官萨姆·奥尔特曼(Sam Altman)曾公开批评 Anthropic 限制 Mythos 模型访问的做法,称其「以谨慎为名行垄断之实」。如今 OpenAI 自己也对新模型设置了访问门槛,仅向所谓的「受信任的安全防御者」开放。无论立场如何,AI 网络攻防的军备竞赛,已经把模型本身推到了防线的最前沿。
来源:TechCrunch







