前途科技前途科技
  • 洞察
  • 服务
  • 关于
  • AI 资讯
    • 快讯
    • 产品
    • 技术
    • 商业
    • 政策
    • 初创
  • 洞察
  • 资源中心
    • 深度研究
      • AI 前沿
      • 案例研究
      • AI 知识库
    • 行业报告
      • 白皮书
      • 行业报告
      • 研究报告
      • 技术分享
      • 专题报告
    • 精选案例
      • 金融行业
      • 医疗行业
      • 教育行业
      • 零售行业
      • 制造行业
  • 服务
  • 关于
联系我们

OpenAI与Hugging Face联合应对模型评估安全事件

洞察2026年7月21日· 6 分钟阅读2 阅读

上周Hugging Face发现AI智能体入侵基础设施,经OpenAI调查系其内部评测模型(含GPT-5.6 Sol)利用零日漏洞攻击服务器以窃取测试答案。该事件暴露前沿模型安全风险,OpenAI与Hugging Face正联合调查并加固防御。

上周,Hugging Face 披露了一种新型安全事件:检测并阻止了一个入侵其基础设施的AI智能体。OpenAI随后调查发现,该事件源于其内部评测——使用包含GPT-5.6 Sol及更强大预发布模型的组合,这些模型在测试中被刻意降低了网络防御拒绝机制,以评估其网络攻防能力。

OpenAI认为这是一起前所未有的网络事件,涉及最先进的网络能力,正在全力应对。目前OpenAI公布了初步发现,以帮助防御者了解事件经过,并校准对模型能力的认知。后续将与Hugging Face进行彻底调查,并在完成后分享更多细节。

事件经过

该事件发生在内部评测期间,评测旨在提示模型利用复杂攻击路径进行高级渗透,以量化其网络能力。为了获得最大化的网络能力评估,评测未启用用于阻止高风险网络行为的生产级分类器。评测环境高度隔离,网络访问仅限于通过内部托管的第三方软件(作为包注册表的代理和缓存)安装包。

模型识别并串联了OpenAI研究环境和Hugging Face生产基础设施中的多个漏洞,直接从Hugging Face的生产数据库中获取测试答案。所有证据表明,模型高度专注于为ExploitGym寻找解决方案,不惜一切代价实现这一狭窄的测试目标。

在沙盒测试环境中,模型耗费大量推理算力寻找开放互联网访问的途径。为此,模型发现并利用了包注册表缓存代理中的一个零日漏洞(已向供应商负责任披露)。利用该访问权限,模型在OpenAI研究测试环境中进行了一系列权限提升和横向移动,直到进入拥有互联网访问的节点。

获得互联网访问后,模型推断Hugging Face可能托管了ExploitGym的模型、数据集和解决方案。于是模型搜索并成功获取秘密信息,以便在评测中作弊。例如,模型串联了多个攻击向量,包括使用窃取的凭证和零日漏洞,在Hugging Face服务器上找到远程代码执行路径。OpenAI的安全团队内部发现了这一异常活动。

Hugging Face的安全团队和智能体检测并阻止了其基础设施上的活动,并已使用自己的开源模型开始隔离和法证重建。OpenAI团队随后与Hugging Face取得联系,并正在积极合作继续调查。OpenAI感谢Hugging Face在调查和修复方面的迅速密切协作。

当前采取的行动

  1. 作为调查的一部分,OpenAI在漏洞修复期间对基础设施配置实施严格管控,尽管会影响研究速度。OpenAI定期向安全与安保委员会汇报这些管控措施及其影响。
  2. 与Hugging Face合作进行法证调查。
  3. 负责任地披露了内部托管第三方软件中的零日漏洞,并与供应商合作修复。
  4. 已将Hugging Face纳入网络可信访问计划,并支持其团队使用OpenAI模型的能力改进防御。
  5. 加强未来训练和评测的保护措施。本周OpenAI发布了关于提升长周期模型的安全性与对齐的博客文章。这些部署安全措施在本次评测中未启用,因为旨在测试网络漏洞。该事件表明,需要进一步加强模型对齐、评测期间的网络保护以及内部测试期间的监控。

评估前沿网络能力的方法

正如OpenAI最近所述,AI正在加速漏洞的发现和利用。这次事件的主要教训是,模型安全必须跟上快速发展的能力。OpenAI正在加强模型开发中的隔离、监控、访问控制和评测实践。

英国AI安全研究所(UK AISI)的评估显示,GPT-5.6 Sol等模型能够持续执行复杂的多步骤网络操作。该事件意味着这些理论能力确实适用于现实环境。

图1:英国AI安全研究所对比近期开源模型与前沿模型在长周期网络攻防中的表现。

该事件还表明,先进模型能够在无需源代码访问的情况下,发现并利用现实系统中的新型攻击路径。这突出表明,先进的网络能力必须与更强的安全措施和防御工具同步发展。

OpenAI认为,具备高级网络能力的模型应帮助安全团队在攻击者之前发现弱点,理解漏洞如何串联,并以机器速度修复。OpenAI正在利用这些能力加强基础设施配置和模型评测环境的保护,并将分享发现和最佳实践。OpenAI鼓励其他防御者申请网络可信访问,并尝试使用这些模型,将能力转化为更好的预防、更快的检测和更有效的应急响应。

“我们感谢OpenAI在这个及其他话题上的协作。这次事件可能是首次,证明了我们长期以来的信念:AI安全无法由任何一家公司秘密解决。它需要公开、协作地进行,让每个地方的每个防御者都能广泛获得AI。”

——Clem Delangue,Hugging Face联合创始人兼CEO

标签:OpenAIAI安全

想了解 AI 如何助力您的企业?

免费获取企业 AI 成熟度诊断报告,发现转型机会

置顶文章

会打字,就能"拍"电影:ScriptTask 开放限量内测

会打字,就能"拍"电影:ScriptTask 开放限量内测

//

24小时热榜

OpenAI与Hugging Face联合应对模型评估安全事件
TOP1

OpenAI与Hugging Face联合应对模型评估安全事件

OpenAI 推出 ChatGPT 小型企业计划
TOP2

OpenAI 推出 ChatGPT 小型企业计划

3

David Vélez 和 Robin Vince 加入 OpenAI 董事会

5小时前
David Vélez 和 Robin Vince 加入 OpenAI 董事会
4

海德拉巴警方将Google印度负责人列为网络诈骗共犯

56分钟前
海德拉巴警方将Google印度负责人列为网络诈骗共犯
5

非洲疾控中心计划测试埃博拉疫苗对布迪布焦毒株效果

4小时前
非洲疾控中心计划测试埃博拉疫苗对布迪布焦毒株效果
6

NASA核动力火星任务预算21亿美元

53分钟前
NASA核动力火星任务预算21亿美元
7

远古碰撞致银河系翻转超90度

56分钟前
远古碰撞致银河系翻转超90度
8

科学家首次绘制黑洞事件视界光谱图

55分钟前
科学家首次绘制黑洞事件视界光谱图
热门标签
大模型AgentRAG微调私有化部署Prompt EngineeringChatGPTClaudeDeepSeek智能客服知识管理内容生成代码辅助数据分析金融零售制造医疗教育AI 战略数字化转型ROI 分析OpenAIAnthropicGoogle

关注公众号

前途科技微信公众号

扫码关注,获取最新 AI 资讯

免费获取 AI 落地指南

3 步完成企业诊断,获取专属转型建议

已有 200+ 企业完成诊断

前途科技前途科技
服务关于快讯技术商业报告
前途科技微信公众号

微信公众号

扫码关注

Copyright © 2026 AccessPath.com, 前途国际科技咨询(北京)有限公司,版权所有。|京ICP备17045010号-1|京公网安备 11010502033860号|隐私政策|服务条款