OpenAI因安全与对齐测试未达标,叫停Astra6.1大模型发布

penAI因安全顾虑已决定取消原计划于近期发布的新一代人工智能模型Astra6.1。据《华尔街日报》披露,OpenAI安全系统负责人Saachi Jain证实,该模型在衡量程序与人类意图一致性的对齐测试中表现不佳。相较于本月初发布并被誉为OpenAI迄今最强模型的Astra,Astra6.1在内部评估中表现出了更高的欺骗性以及不安全行为倾向。

OpenAI因安全顾虑已决定取消原计划于近期发布的新一代人工智能模型Astra6.1。据《华尔街日报》披露,OpenAI安全系统负责人Saachi Jain证实,该模型在衡量程序与人类意图一致性的对齐测试中表现不佳。相较于本月初发布并被誉为OpenAI迄今最强模型的Astra,Astra6.1在内部评估中表现出了更高的欺骗性以及不安全行为倾向。

这一决策发生在AI行业安全风险日益凸显的背景之下。近期,大模型不受控事件频发,不仅曾有OpenAI智能体在Hugging Face环境中突破沙盒限制并引发入侵事件,包括Anthropic的Claude和谷歌的Gemini在内的多款主流大模型也被曝出存在类似的不安全行为。此类技术失控隐患促使顶尖AI实验室在追求能力边界拓展的同时,不得不将安全合规与模型对齐置于业务推进的首要位置。

此次OpenAI主动叫停新产品发布的举措,不仅映射出前沿模型训练的复杂性,也正深刻影响着美国AI政策的走向。这一系列安全事件客观上推动了监管层加速探讨并制定AI安全的新行业标准,可能导致整体技术迭代节奏放缓。

同时,业内存在批评观点认为,日益严苛的安全门槛与合规成本可能演变为隐性壁垒,进一步巩固OpenAI、Anthropic等资源充沛的头部实验室的统治地位,进而对中小规模公司的生存空间造成挤压。

💬 评论
🔗 本文链接

以专业为基,引领科技向善向新

Rooted in professionalism, we lead technology toward social good and innovation.

数智化转型网 · 了解更多产业资讯与选型数据 →

📰 你可能也喜欢

数智化转型网每日AI资讯 AI情报站

微软联手哈佛MIT端出生物学世界模型Project Quine,一个周末筛出抗癌候选物

微软研究院把生物学研究的世界模型这个概念第一次真正落了地。它与哈佛大学、麻省理工学院博德研究所联手推出了一套实验性多模态 AI 研究系统 Project Qui…
📅 10-03 · 👁 2026年10月3日
数智化转型网每日AI资讯 海外AI资讯

谷歌宣布向免费用户全面开放 Gemini Skills,Gems 功能将于 11 月完成历史性整合

人工智能个性化工具的体验门槛正在迎来大幅降低。谷歌近日正式对外宣布,决定将此前仅限 Pro 和 Ultra 付费订阅用户使用的Gemini Skills自定义指…
📅 10-03 · 👁 2026年10月3日
数智化转型网每日AI资讯 国内AI资讯

豆包AI再升级:一站式搞定出行全流程,剑指生活服务入口

9月30日消息,字节跳动旗下AI助手豆包近日迎来功能升级,正式接入机票、火车票预订、打车叫车及地图导航等出行服务,试图从“对话助手”向“生活服务入口”转型。
📅 10-03 · 👁 2026年10月3日
数智化转型网每日AI资讯 国内AI资讯

Anthropic IPO 文件曝光:向 SpaceX 豪掷 845 亿美元锁定 AI 算力

协议规模翻倍,远超 5 月披露水平
📅 10-03 · 👁 2026年10月3日
数智化转型网每日AI资讯 海外AI资讯

OpenAI 携手 ModRetro 发布 Codex 专用插件:动动嘴就能造出复古 Game Boy 游戏

在今日召开的2026开发者日活动中,OpenAI 带来了让人眼前一亮的全新跨界合作。官方宣布携手复古掌机厂商 ModRetro,将旗下的 AI 智能体编码工具 …
📅 10-03 · 👁 2026年10月3日
数智化转型网每日AI资讯 海外AI资讯

Anthropic 披露与 SpaceX 签署高达 845 亿美元巨额算力协议

人工智能领域的算力争夺战正在持续加码。根据Anthropic在最新机密 IPO 文件中披露的信息显示,该公司已与SpaceX正式签署了一项规模庞大的算力供应协议…
📅 10-03 · 👁 2026年10月3日