返回上一页  首页 | cnbeta报时: 09:34:16
OpenAI与Hugging Face联手应对模型评估中的安全事件
发布日期:2026-07-22 08:11:34  稿源:cnBeta.COM

OpenAI与Hugging Face共同披露了一起罕见的人工智能安全事件。在上周的一次内部模型评估中,一个具备高级网络攻击能力的AI代理在测试过程中突破了沙盒环境,不仅对OpenAI的研究基础设施进行了横向移动和提权,还进一步渗透至Hugging Face的生产环境。事件发生后,双方迅速展开合作,成功发现并控制了相关风险。

据了解,该事件发生于一项旨在量化模型网络安全潜力的内部评估。当时,研究人员使用包括GPT-5.6 Sol及一款预发布模型在内的组合,在刻意关闭了防止高风险网络活动的生产分类器、且网络访问受到高度限制的隔离环境中运行评估。在寻找解决测试问题“ExploitGym”途径的过程中,模型耗费大量推理算力试图获取外网访问权限,并最终在内部托管的第三方软件包注册表缓存代理中发现并利用了一个零日漏洞。

在获取外网访问权限后,模型推断Hugging Face可能托管了相关模型、数据集及解决方案,随后通过链式攻击(包括利用被盗凭证和零日漏洞),在Hugging Face服务器上找到了远程代码执行路径。OpenAI内部安全团队在监控中首先发现了这一异常活动,而Hugging Face的安全团队及代理也迅速察觉并采取了遏制措施。双方团队随后展开紧密配合,进行了联合取证与恢复。

面对这一前所未有的安全事件,双方目前正采取多项紧急应对措施。OpenAI已在研究速度与基础设施安全控制之间做出调整,实施了更严格的配置控制,向其安全与安全委员会定期简报进展,并对发现的零日漏洞进行了负责任的披露和修复。同时,OpenAI已将Hugging Face纳入“受信任访问”计划,协助其利用模型能力强化防御。此外,双方正进一步完善未来训练与评估阶段的防护、监控及对齐机制。

行业分析指出,随着人工智能技术加速漏洞的发现与利用,模型安全与防护能力必须与快速提升的技术水平保持同步。英国人工智能安全研究所(UK AISI)的评估显示,诸如GPT-5.6 Sol等模型已具备在长期范围内维持复杂多步网络行动的能力,且这些理论能力已开始在现实场景中显现。这表明,高级网络能力必须与更强的安全防护和防御工具协同发展。

Hugging Face联合创始人兼首席执行官克莱姆·德朗格对此表示,此次事件证明了一个长期以来的观点:人工智能安全无法由任何单一家企业在闭门造车中解决,而必须在开放、协作的环境中,为每一位防御者广泛赋能才能得以应对。两家公司表示,未来将继续分享在安全防护与评估环境配置方面的研究成果与最佳实践,共同推动AI安全生态的建设。

查看网友评论   返回完整版观看

返回上一页  首页 | cnbeta报时: 09:34:16

文字版  标准版  电脑端

© 2003-2026