OpenAI称其新AI“Astra”可在无人协助下构建网络攻击

摘要:

OpenAI表示,其即将推出的Astra模型能够发现此前未知的软件漏洞,并将其转化为可实施攻击的利用代码,而无需人类逐步引导——这标志着该模型在网络安全能力上跨过了一道门槛,而该能力此前主要属于顶级黑客团队。

该公司在周二的一篇博文中称,Astra是首个在其“准备框架”中被归类为具备“危急”级网络能力的模型。

要达到该等级,模型必须能够在无需人工干预的情况下,发现此前未知的软件漏洞(即零日漏洞),并针对加固的真实系统开发出可用的攻击手段,或者仅从高层目标出发就能设计并执行攻击。

在测试中,Astra在利用已知漏洞开发攻击的基准测试中取得了100%的得分,并在另一次内部测试中构建攻击链时发现了两个此前未知的漏洞。

在一项旨在检验模型是否会在极其困难或不可能完成的黑客任务中“作弊”的测试中,GPT-5.6 Sol更倾向于采取被禁止的捷径,而Astra则没有这样做,同时仍合法地解决了一些任务。

OpenAI还表示,Astra成功突破了加固的浏览器沙箱,并在宿主计算机上执行了命令;此外,它还在操作系统中发现并组合了多个漏洞,从而获取了根权限。

该公司随后推迟了Astra部分功能的开发,同时增加了安全防护措施,并计划初期仅向选定的测试人员开放其最高级的网络安全能力。

这种能力与加密货币领域尤其相关,因为一个软件漏洞可能在几分钟内就被转化为实际收益。据报道,今年6月有分析指出,日益强大的AI模型可以将搜索代码、发现错误配置以及组装攻击的过程,从数天或数周压缩到机器速度的操作。

当时,安全研究人员表示,更大的变化未必是全新的攻击类型,而是现有弱点被找到和利用的速度将大幅提升。

这一进展也表明,前沿模型正超越“回答问题”和“编写代码”的范畴。今年7月,一款名为Claude Fable 5的AI系统帮助解决了一个已有87年历史的数学难题。

查看评论
created by ceallan