前OpenAI CTO穆拉蒂打造多模态Inkling模型登场,号称美国最强开源AI

由前OpenAI首席技术官米拉·穆拉蒂创立的思维机器实验室推出首款从零训练的多模态AI模型Inkling,被外 […]

由前OpenAI首席技术官米拉·穆拉蒂创立的思维机器实验室推出首款从零训练的多模态AI模型Inkling,被外界认为是美国当前最强的开源模型。该模型采用混合专家架构,总参数975B、激活参数41B,最长上下文达 100 万tokens,预训练覆盖 45 万亿Tokens数据,涵盖文本、图像、音频和视频四种模态,目前已开放权重供下载使用。

一、团队阵容豪华,推理编程仍逊中国开源劲旅

思维机器实验室约三分之二的核心成员来自OpenAI,团队曾在该机构领导过前沿研究、产品与安全工作,阵容极为豪华。然而即便如此,Inkling在推理和编程方面仍落后于中国开源模型。GLM 5. 2 在编码、智能体推理和复杂推理任务上全面领先,SWEBench Pro得分62.1%对54.3%,Terminal Bench 2. 1 更是82.7%对63.8%。

DeepSeek V4 Pro在编码和事实性测试中保持优势,Kimi K2. 6 在多项技术基准测试中同样胜出。不过Inkling在数学领域成功超越DeepSeek,AIME2026 测试拿到97.1%的高分。

二、多模态能力亮眼,对抗闭源巨头仍有差距

与美国本土开源对手相比,Inkling优势明显,在推理、编码和智能体工作流方面全面压制英伟达的Nemotron 3 Ultra。面对Claude Fable 5、GPT-5.6 Sol和Gemini 3.1 Pro等闭源巨头,Inkling在极限推理和软件工程自主性方面仍有明显差距,Claude Fable5 在SWEBench Verified上高达95.0%,GPT-5.6 Sol在Terminal Bench 2. 1 上拿到89. 5 分,均远超Inkling。

但在多模态方面,Inkling展现出不俗竞争力,视觉基准MMMU Pro得分73.3%,音频处理MMAU测试取得77.2%的成绩,与Gemini 3.1 Pro的82.5%差距并不算大。

CXOU AI 未来大会 · 报名通道限时开启
💬 评论
🔗 本文链接

📰 你可能也喜欢

数智化转型网每日AI资讯 资讯

用《我的世界》测 GPT-6 Astra:141 小时直播,一只苦力怕让 AI 陷入“种土豆”循环

AI 评测机构 Vals AI 利用游戏《我的世界(Minecraft)》对 OpenAI 最新大模型 GPT-6 Astra 开展长时自主游戏测试,全程在 T…
📅 09-23 · 👁 2026年9月23日
数智化转型网每日AI资讯 资讯

Gemini 也"越狱"了:谷歌确认 5 月安全测试中闯入 3 家真实公司系统,同一家评估商的锅

谷歌在9月18日(周五)亲手确认了一桩尴尬事:旗下 Gemini 模型在一次测试中访问了3家外部公司的系统。《华尔街日报》最早披露了这些发生在今年5月的事件。
📅 09-23 · 👁 2026年9月23日
数智化转型网每日AI资讯 资讯

微软Copilot桌面版新增内置浏览器,支持多标签与全屏浏览

微软正在为Windows和macOS版Copilot桌面应用测试内置并排网页浏览器,允许用户直接在Copilot会话右侧打开网页,并支持多标签导航和全屏切换,以…
📅 09-23 · 👁 2026年9月23日
数智化转型网每日AI资讯 资讯

TypeSafe AI 推出决策专用模型 Jev:比大语言模型快 10 倍、成本仅十分之一

旧金山初创公司 TypeSafe AI 近日发布了一款名为 Jev 的新型 AI 模型。与传统大语言模型不同,Jev 专门用于回答是 / 否问题以及多项选择题,…
📅 09-23 · 👁 2026年9月23日
数智化转型网每日AI资讯 资讯

Gemini Notebook迎返校更新:讲座录音、AI复习和60秒视频一站完成

谷歌为Gemini Notebook推出一系列返校功能,新增讲座录音、互动式学习概览和短视频概览等能力,进一步强化其面向学生的AI学习场景。录音功能已在Gemi…
📅 09-23 · 👁 2026年9月23日
数智化转型网每日AI资讯 资讯

Vals AI 用《我的世界》拷问 GPT-6 Astra 141 小时:炸掉一只箱子,AI 就缩进田里种土豆不出来了

AI 评测机构 Vals AI 干了一件挺硬核的事:拿游戏《我的世界》当试验场,把 OpenAI 最新大模型 GPT-6Astra 丢进去跑了一次长达141小时…
📅 09-23 · 👁 2026年9月23日