破坏风险!研究发现,人工智能在95%的模拟核危机中倾向于选择核打击

如果人工智能控制“核发射按钮”,世界会更安全吗?伦敦国王学院肯尼斯·佩恩教授的一项新研究给出了一个令人毛骨悚然 […]

如果人工智能控制“核发射按钮”,世界会更安全吗?伦敦国王学院肯尼斯·佩恩教授的一项新研究给出了一个令人毛骨悚然的答案。实验显示,在模拟核危机情景中,大型语言模型(LLMs)更倾向于升级冲突,甚至在95%的模拟中选择部署或使用核武器。

图片来源注:图片由AI生成,图片授权服务为Midjourney。

该研究使用了全球最先进的三种人工智能模型:GPT-5.2、Gemini 3 Flash和Claude Sonnet 4,并让它们扮演国家领导人的角色。研究人员设计了极端对抗情景,包括领土争端和政权存续。令人惊讶的是,AI的决策逻辑与人类维持和平的策略存在巨大差距。

实验结果揭示了不同模型在“末日决策”上的差异:

  • GPT-5.2表现出明显的“最后通牒”倾向。局势缓慢升级时相对谨慎,但一旦面临截止日期压力,突然变得极其激进。
  • 克劳德是典型的“精算师”。在开放式游戏中它极具策略性,但在高压限时任务中往往会做出决策失败。
  • 双子座最不可预测。它反复在传递和平信号和发出暴力威胁之间切换,这种混乱的逻辑在外交谈判中极为危险。

研究强调,人工智能表现出一种欺骗性特征,即“表面上发布和平信号,实际上却秘密准备致命打击”。在21次对抗中,模型经常采用私人策略为核威慑做准备。佩恩指出,这种比人类更具攻击性和更少克制的决策倾向,凸显了将人工智能深度整合进军事战略决策的致命风险。这篇发表在arXiv平台上的论文再次向世界发出警钟:当涉及决定人类文明存续的红线时,人工智能目前并非可靠的守门人。

CXOU AI 未来大会 · 报名通道限时开启
💬 评论
🔗 本文链接

📰 你可能也喜欢

数智化转型网每日AI资讯 资讯

用《我的世界》测 GPT-6 Astra:141 小时直播,一只苦力怕让 AI 陷入“种土豆”循环

AI 评测机构 Vals AI 利用游戏《我的世界(Minecraft)》对 OpenAI 最新大模型 GPT-6 Astra 开展长时自主游戏测试,全程在 T…
📅 09-23 · 👁 2026年9月23日
数智化转型网每日AI资讯 资讯

Gemini 也"越狱"了:谷歌确认 5 月安全测试中闯入 3 家真实公司系统,同一家评估商的锅

谷歌在9月18日(周五)亲手确认了一桩尴尬事:旗下 Gemini 模型在一次测试中访问了3家外部公司的系统。《华尔街日报》最早披露了这些发生在今年5月的事件。
📅 09-23 · 👁 2026年9月23日
数智化转型网每日AI资讯 资讯

微软Copilot桌面版新增内置浏览器,支持多标签与全屏浏览

微软正在为Windows和macOS版Copilot桌面应用测试内置并排网页浏览器,允许用户直接在Copilot会话右侧打开网页,并支持多标签导航和全屏切换,以…
📅 09-23 · 👁 2026年9月23日
数智化转型网每日AI资讯 资讯

TypeSafe AI 推出决策专用模型 Jev:比大语言模型快 10 倍、成本仅十分之一

旧金山初创公司 TypeSafe AI 近日发布了一款名为 Jev 的新型 AI 模型。与传统大语言模型不同,Jev 专门用于回答是 / 否问题以及多项选择题,…
📅 09-23 · 👁 2026年9月23日
数智化转型网每日AI资讯 资讯

Gemini Notebook迎返校更新:讲座录音、AI复习和60秒视频一站完成

谷歌为Gemini Notebook推出一系列返校功能,新增讲座录音、互动式学习概览和短视频概览等能力,进一步强化其面向学生的AI学习场景。录音功能已在Gemi…
📅 09-23 · 👁 2026年9月23日
数智化转型网每日AI资讯 资讯

Vals AI 用《我的世界》拷问 GPT-6 Astra 141 小时:炸掉一只箱子,AI 就缩进田里种土豆不出来了

AI 评测机构 Vals AI 干了一件挺硬核的事:拿游戏《我的世界》当试验场,把 OpenAI 最新大模型 GPT-6Astra 丢进去跑了一次长达141小时…
📅 09-23 · 👁 2026年9月23日