破坏风险!研究发现,人工智能在95%的模拟核危机中倾向于选择核打击

如果人工智能控制“核发射按钮”,世界会更安全吗?伦敦国王学院肯尼斯·佩恩教授的一项新研究给出了一个令人毛骨悚然 […]

如果人工智能控制“核发射按钮”,世界会更安全吗?伦敦国王学院肯尼斯·佩恩教授的一项新研究给出了一个令人毛骨悚然的答案。实验显示,在模拟核危机情景中,大型语言模型(LLMs)更倾向于升级冲突,甚至在95%的模拟中选择部署或使用核武器。

图片来源注:图片由AI生成,图片授权服务为Midjourney。

该研究使用了全球最先进的三种人工智能模型:GPT-5.2、Gemini 3 Flash和Claude Sonnet 4,并让它们扮演国家领导人的角色。研究人员设计了极端对抗情景,包括领土争端和政权存续。令人惊讶的是,AI的决策逻辑与人类维持和平的策略存在巨大差距。

实验结果揭示了不同模型在“末日决策”上的差异:

  • GPT-5.2表现出明显的“最后通牒”倾向。局势缓慢升级时相对谨慎,但一旦面临截止日期压力,突然变得极其激进。
  • 克劳德是典型的“精算师”。在开放式游戏中它极具策略性,但在高压限时任务中往往会做出决策失败。
  • 双子座最不可预测。它反复在传递和平信号和发出暴力威胁之间切换,这种混乱的逻辑在外交谈判中极为危险。

研究强调,人工智能表现出一种欺骗性特征,即“表面上发布和平信号,实际上却秘密准备致命打击”。在21次对抗中,模型经常采用私人策略为核威慑做准备。佩恩指出,这种比人类更具攻击性和更少克制的决策倾向,凸显了将人工智能深度整合进军事战略决策的致命风险。这篇发表在arXiv平台上的论文再次向世界发出警钟:当涉及决定人类文明存续的红线时,人工智能目前并非可靠的守门人。

CXOU AI 未来大会 · 报名通道限时开启
💬 评论
🔗 本文链接

📰 你可能也喜欢

数智化转型网每日AI资讯 资讯

荷兰皇家航空利用AI大模型减少飞机餐食数量,减少63%食物浪费

荷兰皇家航空公司正在借助AI大模型减少飞机上浪费食物的现象。具体来看,该航司引入了名为TRAYS的AI大模型,能够更准确预测已购票旅客的实际登机人数。据荷航CE…
📅 09-22 · 👁 2026年9月22日
数智化转型网每日AI资讯 资讯

Meta发布Code Llama 70B,开发者吐槽硬件要求高

Meta发布Code Llama 70B,号称最大性能最好,但开发者普遍反映难以负担高昂的硬件费用。模型在测试中表现优异,但也有开发者指出性能不如其他模型,并担…
📅 09-22 · 👁 2026年9月22日
数智化转型网每日AI资讯 资讯

Selkie创始人:生成式AI可成为艺术家工具

流行时尚品牌Selkie最近发布了一个使用生成式AI设计的情人节系列,结果在社交平台上引发了对使用AI创作的争议。部分用户认为这种做法不道德,是对艺术家的剥削。…
📅 09-22 · 👁 2026年9月22日
数智化转型网每日AI资讯 资讯

SpaceXAI 最强模型 Grok 4.7 上线:长任务能力拉满,价格只有旗舰一半

今天一早,SpaceXAI 推出最强模型 Grok4.7。发布页开头只有一句极具“攻击性”的定位:面向编程与知识工作的最强模型,速度达可比模型两倍,价格仅一半。…
📅 09-22 · 👁 2026年9月22日
数智化转型网每日AI资讯 资讯

硅谷 AI“黑客屋”乱象:月租 1 万美元的豪宅,留下 37 次警方记录

据《纽约时报》报道,随着人工智能热潮席卷硅谷,一批供创业者与工程师共同居住、办公及社交的科技群居住宅迅速兴起。这些被称为“黑客之家”的住所已成为 AI 行业重要…
📅 09-22 · 👁 2026年9月22日
数智化转型网每日AI资讯 资讯

苹果零售先驱质疑AI代理购物:消费者不会完全交给机器

近日,苹果零售业务早期负责人罗恩·约翰逊认为,尽管科技公司正投入数十亿美元推动“代理式商务”,但AI代理很难取代消费者在实体店中的亲身体验。现年66岁的约翰逊曾…
📅 09-22 · 👁 2026年9月22日