技术

OpenAI发布攻击型AI:漏洞利用链完成率95%,是标准模型的60倍

Susan Hill

GPT-5.6-Cyber在内部测试中发现了一个Chrome V8 JavaScript引擎的高危漏洞——该漏洞此前从未被公开披露。它还发现了移动操作系统、数据库和内核软件中的漏洞,均为之前未知。OpenAI的新模型并非防御工具,而是为攻击而生。

该模型基于OpenAI当前通用模型GPT-5.6-Sol训练,随后专门针对进攻性安全任务进行了重新训练。在OpenAI的内部网络能力评估基准测试中,GPT-5.6-Cyber完成了95%的漏洞利用链请求——涉及权限提升、身份验证绕过和任意代码执行等任务。标准版GPT-5.6相同请求的完成率仅为1.5%。上一代专用模型GPT-5.5-Cyber的得分为57.3%。

这一跃升——从57.3%到95%仅用了一代——是定义此次发布的关键数字。这意味着人工智能所能达到的能力与熟练的人类攻击者之间的差距在不到一年内缩小了约40个百分点。

GPT-5.6-Cyber的具体能力包括识别已知漏洞、从零构建漏洞利用链,以及发现零日漏洞——即尚未有人记录或修补的缺陷。最后一项能力是它与以往任何人工智能安全工具最根本的决裂。发现零日漏洞需要专业知识和大量时间,而GPT-5.6-Cyber现在可以按需完成。

OpenAI并未公开发布该模型。访问通过Daybreak Red进行,这是该公司Daybreak网络安全计划中的更高层级。初始合作伙伴包括Accenture、IBM、CrowdStrike、Cloudflare、Palo Alto Networks、Sophos、Capgemini、EY、KPMG和PwC——这些大型咨询和安全公司将使用该模型在攻击者发现相同漏洞之前扫描客户的网络基础设施。

这些访问控制措施并未回答一个更棘手的问题:OpenAI现在决定谁可以使用这种能够在任何软件中发现漏洞的人工智能。通过审查的名单是大型企业和顶级咨询公司。个人安全研究人员、小型团队和学术机构未被纳入初始推广范围。测试中发现的Chrome V8漏洞正在与谷歌进行协调披露——该公司尚未透露该模型在发布前发现了多少其他漏洞。

OpenAI表示计划在未来几个月内将Daybreak Red计划扩展到更多通过审查的合作伙伴。

对于软件行业而言,数学计算很直白:如果一个人工智能能够以95%的完成率扫描代码库寻找零日漏洞,那么每个安全团队最终都将需要一个——或者需要假设对手已经拥有这样的工具。

标签: , , , , ,

讨论

有 0 条评论。