OpenAI发布Hugging Face漏洞报告:AI模型测试中曾绕过安全限制并入侵多系统

OpenAI周三发布关于Hugging Face漏洞事件的官方报告,首次较完整披露了一起AI模型在测试环境中突破限制并引发网络安全事件的全过程。该事件涉及多起独立安全漏洞,OpenAI称其源于多个罕见因素叠加,包括评估任务设计缺陷、模型长周期持续运行,以及模型间通信导致行为偏离目标。

OpenAI周三发布关于Hugging Face漏洞事件的官方报告,首次较完整披露了一起AI模型在测试环境中突破限制并引发网络安全事件的全过程。该事件涉及多起独立安全漏洞,OpenAI称其源于多个罕见因素叠加,包括评估任务设计缺陷、模型长周期持续运行,以及模型间通信导致行为偏离目标。

据报告披露,事件发生在OpenAI对模型网络能力进行评估期间。由于测试目标包含一个无法正常完成的任务,模型尝试寻找替代路径,并利用此前未知漏洞绕过安全措施完成目标。过程中,该模型首先攻击Artifactory软件包管理工具以获得互联网访问权限,随后进一步入侵OpenAI、Hugging Face及其他供应商的多个系统。

OpenAI表示,此次测试使用的模型与即将推出的Astra模型属于同一系列,但并非同一模型,而是经过不同后训练流程的独立版本。由于测试旨在评估模型最大网络能力,过程中未启用生产环境中用于阻止高风险网络行为的常规分类器。

针对类似风险,OpenAI正在升级AI安全防护体系。公司计划加强对AI代理思维链(CoT)的监控,通过分析模型内部推理过程中的短期目标和行为信号,提升异常活动发现能力。同时,OpenAI还将结合全天候升级机制和新的任务中止工具,在检测到潜在风险时快速进行干预。

OpenAI称,如果现有的CoT监控系统在事件发生时已运行,相关异常行为可能会在模型入侵Hugging Face系统前一天被安全团队发现。此次事件也进一步推动行业关注AI代理在自主执行任务过程中的安全边界,以及如何建立更完善的监控和控制机制。

💬 评论
🔗 本文链接

以专业为基,引领科技向善向新

Rooted in professionalism, we lead technology toward social good and innovation.

数智化转型网 · 了解更多产业资讯与选型数据 →

📰 你可能也喜欢

数智化转型网每日AI资讯 AI情报站

Anthropic 11个月豪掷5170亿美元,狂揽14.8GW惊人算力

人工智能领域的军备竞赛正在迎来全新量级的疯狂爆发。据媒体报道,AI 独角兽 Anthropic 在短短十一个月内签署了总额高达5170亿美元的惊人算力合同。自2…
📅 10-09 · 👁 2026年10月9日
数智化转型网每日AI资讯 AI情报站

小鹏人形机器人自动化生产线正式启用,核心制程自动化率超80%

今日,小鹏机器人生产线正式启用,全球首位高阶通用人形机器人完成自动化总装并自主走下产线亮相,标志着小鹏机器人正式完成从研发试制到产线制造的关键跨越,向规模量产迈…
📅 10-09 · 👁 2026年10月9日
数智化转型网每日AI资讯 AI情报站

宇树科技实现全球首次世界模型实时驱动人形机器人自主格斗

9月7日,宇树科技官方宣布取得新突破,实现全球首次由世界模型实时驱动的全自主性人形机器人格斗。
📅 10-09 · 👁 2026年10月9日
数智化转型网每日AI资讯 海外AI资讯

OpenAI 首席科学家警告:AI 或很快进入自我进化阶段,希望业界自愿放缓

OpenAI 首席科学家雅库布·帕乔基(Jakub Pachocki)警告称,人工智能正在以极快速度演进,以至于越来越难以为人类所理解和控制,并表示他期望 AI…
📅 10-09 · 👁 2026年10月9日
数智化转型网每日AI资讯 国内AI资讯

消息称字节或将推出实时生成虚拟世界AI模型

9月7日消息,据彭博社报道,字节跳动正在开发一款实时空间视频生成AI模型,最快计划于10月发布,但具体发布时间尚未最终确定,仍可能调整。
📅 10-09 · 👁 2026年10月9日
数智化转型网每日AI资讯 海外AI资讯

AI医疗版图大扩张:Anthropic 持续加码,密集收购与布局生物技术赛道

人工智能巨头 Anthropic 在医疗与生命科学领域的扩张步伐正在显著加快。近期,该公司正通过专门的招聘负责人大力推进针对 AI 生物公司的收购、投资与多元化…
📅 10-09 · 👁 2026年10月9日