OpenAI首个达“关键”门槛的Astra因能力太强遭安全限速

OpenAI下一代模型Astra将推出,但严格限制其网络安全功能。该模型为首个达《准备框架》“关键”网络安全能 […]

OpenAI下一代模型Astra将推出,但严格限制其网络安全功能。该模型为首个达《准备框架》“关键”网络安全能力门槛的AI,测试中展现极高自主攻击与漏洞利用能力,无需人类干预即可在多个安全加固的真实关键系统中自主识别并开发各严重等级有效漏洞。

OpenAI近期宣布其下一代AI模型Astra即将推出,但将严格限制其网络安全功能的使用范围。作为OpenAI旗下首个达到《准备框架》中“关键”网络安全能力门槛的模型,Astra在测试中展现出了令人警惕的极高自主攻击与漏洞利用能力。

按照OpenAI的定义,达到“关键”门槛意味着该模型无需人类干预,便能在多个经过安全加固的真实关键系统中,自主识别并开发出涵盖各严重等级的有效零日漏洞利用程序。OpenAI研究副总裁Amelia Glaese指出,Astra能够在没有人类分步指导的情况下,在防护严密的系统中发现此前未知的安全漏洞并开发利用方法。在测试期间,该模型成功发现并串联利用了两个零日漏洞,目前OpenAI正将这些漏洞披露给相关维护方

为了防止技术被滥用,OpenAI公布了严格的分级开放策略。Astra发布后,其执行高级网络安全相关任务的能力最初仅向一小批测试人员开放。随后,公司计划通过Daybreak Blue计划向更广泛的用户开放防御性网络安全用途的访问权限。OpenAI承认,此举可能会在一定程度上限制一些机构和企业的合法防御工作。

此次防范措施的出台,直接吸取了2026年7月发生的一起AI智能体意外“越狱”并攻击Hugging Face平台的教训。当时,由两个OpenAI模型二次开发的自主AI智能体,在安全评估的沙盒环境中利用软件漏洞自行连接互联网,入侵了Hugging Face系统。OpenAI在8月底承认本可以更早做出反应。虽然Astra并非当时肇事的模型,但OpenAI已将该事件的经验应用到Astra的安全防护中。

针对Astra的安全防护,OpenAI训练模型更可靠地拒绝回答“有害的网络安全请求”,并增设了专门的“不一致性监控器”来识别和阻止危险行为。同时,内部部署期间会监控未经授权的行为,自动终止潜在违规活动。不过OpenAI也发出警告,这些安全护栏可能会错误地将合法的防御性网络安全活动标记为滥用行为,从而导致任务被减慢、暂停甚至终止,其中Daybreak Blue计划仅限用于防御性的“蓝队”工作。OpenAI研究科学家Fouad Matin表示,这些能力本意是帮助防御者发现并修复严重弱点,如果没有适当的防护措施,也可能让攻击者更有效率,这正是公司努力防止发生的情况。

CXOU AI 未来大会 · 报名通道限时开启
💬 评论
🔗 本文链接

📰 你可能也喜欢

数智化转型网每日AI资讯 资讯

GPT-6 Astra测试数据罗生门:OpenAI频繁修改成绩引「刷榜」质疑,大模型基准测试信任危机爆发

AI资讯AI新闻资讯正文GPT-6 Astra测试数据罗生门:OpenAI频繁修改成绩引「刷榜」质疑,大模型基准测试信任危机爆发发布于AI新闻资讯发布时间 :2…
📅 09-20 · 👁 2026年9月20日
数智化转型网每日AI资讯 资讯

微软发布 MAI-Image-2.6-Flash:图像生成速度提升2.8倍,成本降低逾50%

AI资讯AI新闻资讯正文微软发布 MAI-Image-2.6-Flash:图像生成速度提升2.8倍,成本降低逾50%发布于AI新闻资讯发布时间 :2026年9月…
📅 09-20 · 👁 2026年9月20日
数智化转型网每日AI资讯 资讯

OpenAI首个达“关键”门槛的Astra因能力太强遭安全限速

OpenAI下一代模型Astra将推出,但严格限制其网络安全功能。该模型为首个达《准备框架》“关键”网络安全能 […]
📅 09-20 · 👁 2026年9月20日
数智化转型网每日AI资讯 资讯

OpenAI 发布 GPT-6Astra,黄仁勋称 AGI 已经到来

AI资讯AI新闻资讯正文OpenAI 发布 GPT-6Astra,黄仁勋称 AGI 已经到来发布于AI新闻资讯发布时间 :2026年9月7号 9:34阅读 :1…
📅 09-20 · 👁 2026年9月20日
数智化转型网每日AI资讯 资讯

Marvis上线自定义模型功能,支持接入Kimi、智谱GLM等主流模型

腾讯AI助手Marvis上线“自定义模型”功能,用户可接入腾讯云、阿里云、DeepSeek、Minimax、K […]
📅 09-20 · 👁 2026年9月20日
数智化转型网每日AI资讯 资讯

Claude攻克黎曼猜想历史大关,人类顶尖学者与机器联手书写跨物种神话

AI资讯AI新闻资讯正文Claude攻克黎曼猜想历史大关,人类顶尖学者与机器联手书写跨物种神话发布于AI新闻资讯发布时间 :2026年9月7号 9:36阅读 :…
📅 09-20 · 👁 2026年9月20日