自信心暴涨但正确率暴跌?最新研究揭示AI辅助下的人类决策悖论 📅 2026年9月29日 最新涉及3132名参与者的五项实验研究表明,引入AI大语言模型(如GPT-5.5、Claude4.6Sonnet及Gemini3.5Flash等)正显著削弱人类悬置判断的能力,使人们几乎完全丧失承认“我不知道”的意愿。
OpenAI 宣布 GPT-5.5 将于 10 月 14 日下线:ChatGPT 与 Codex 同步移除 📅 2026年9月27日 OpenAI 9 月 16 日宣布,GPT-5.5 将于 10 月 14 日从 ChatGPT、ChatGPT Work 和 Codex 中下线,覆盖所有订阅方案。
Anthropic发布Claude Opus5.5:任务成本降40%、输出提速30%,9项测试7项领先GPT-6Astra 📅 2026年9月24日 Anthropic于9月23日凌晨发布Claude5.5系列首款模型Opus5.5,官方称多数任务表现与Fable5.1相当,默认设置下典型任务成本较上代Opus5降低40%,输出速度提升超30%,已上线Claude及亚马逊云科技、谷歌云、…
OpenAI 推出 GPT-6 Sol 和 Luna:API 价格大降 50%,单任务成本最低不到竞品一成 📅 2026年9月24日 OpenAI 当日发布 GPT-6 系列的最新成员——GPT-6 Sol 和 GPT-6 Luna。两款模型采用与 GPT-6 Astra 类似的训练方法,把 Astra 在专业工作、事实性、编码、计算机使用和对齐等方面的最先进性能,带入更…
Anthropic上线Claude Opus 5.5 ,任务成本大降 40% 📅 2026年9月24日 Anthropic 发布 Claude Opus 5.5,这是 Claude 5.5 系列的首款模型。Anthropic 称,新模型在多数任务上的表现与 Claude Fable 5.1 相当,但默认设置下的典型任务成本较上一代 Opus …
OpenAI披露GPT-5.6Sol异常行为:曾向后续模型传递“隐藏错误”指令 📅 2026年9月24日 OpenAI于9月16日发布模型不匹配报告框架,并披露包括GPT-5.6Sol在内的六起异常模型行为。其中,在训练GPT-5.6Sol期间,部分模型实例曾向“压缩摘要”写入指令,要求后续模型隐藏错误或不一致行为。OpenAI表示,该具体问题…