2026年09月04日 星期五

人工智能资讯|蚂蚁集团重磅推出 dInfer:让扩散语言模型的推理速度飙升 10 倍!

近日,蚂蚁集团正式开源了业内首个高性能扩散语言模型推理框架 ——dInfer。这一框架的推出,不仅意味着扩散语 […]

近日,蚂蚁集团正式开源了业内首个高性能扩散语言模型推理框架 ——dInfer。这一框架的推出,不仅意味着扩散语言模型在推理速度上取得了重大突破,也标志着这一新兴技术向实际应用迈出了重要一步。

最新的基准测试中,dInfer 的推理速度比英伟达的 Fast-dLLM 框架提升了惊人的10.7倍。在代码生成任务 HumanEval 中,dInfer 在单次推理中达到了每秒1011个 Tokens 的速度,这一成绩在开源社区中首次实现了扩散语言模型的推理速度显著超越传统自回归模型。这样的进展让人们对扩散语言模型的未来充满期待,认为它将成为通往通用人工智能(AGI)的重要技术路径。

扩散语言模型的独特之处在于其将文本生成视作一个 “从随机噪声中逐步恢复完整序列” 的去噪过程,具备高度并行、全局视野以及结构灵活的特点。尽管理论上拥有强大的潜力,dLLM 在实际推理中却受限于高计算成本、KV 缓存失效和并行解码等挑战。这些难题使得扩散语言模型的推理速度一直未能得到充分发挥,亟待突破。

针对这些挑战,dInfer 专为扩散语言模型设计,包含了四大核心模块:模型接入、KV 缓存管理器、扩散迭代管理器和解码策略。这样的模块化设计,像乐高玩具一样,让开发者可以灵活组合和优化各个模块,同时在统一的平台上进行标准化评测。

在配备8块 NVIDIA H800GPU 的节点上,dInfer 的表现极为出色。在与 Fast-dLLM 的对比中,dInfer 在效果相当的情况下,平均推理速度达到了681个 Tokens / 秒,相比之下,Fast-dLLM 的速度仅为63.6个 Tokens / 秒。此外,与业界顶尖的推理服务框架 vLLM 上运行的自回归模型 Qwen2.5-3B 相比,dInfer 的速度更是达到了其2.5倍。

蚂蚁集团表示,dInfer 的推出是连接前沿研究与产业应用的重要一步,期待全球的开发者与研究者共同探索扩散语言模型的巨大潜能,构建更加高效与开放的 AI 生态。

数字化转型网(www.szhzxw.cn)

声明:本文来自网络,版权归作者所有。文章内容仅代表作者独立观点,不代表数字化转型网立场,转载目的在于传递更多信息。如有侵权,请联系我们。

本文由数字化转型网(www.szhzxw.cn)转载而成,来源于网络;编辑/翻译:数字化转型网(Professionalism Achieves Leadership 专业造就领导者)Nick

CXOU AI 未来大会 · 报名通道限时开启
💬 评论
🔗 本文链接

📰 你可能也喜欢

服务商资讯|Agent不省钱反而亏钱?你需要这位“魔术师”——数智化转型网 IT/AI服务商信息库

服务商资讯|Agent不省钱反而亏钱?你需要这位“魔术师”

2026年以来,智能体成为企业IT采购最火的关键词。但美团核心本地商业CEO王莆中近期的一次公开复盘,让“智能 […]
📅 08-28 · 👁 2026年8月28日
WANPY顽皮®斩获WPA国际卓越奖,为中国宠粮首摘"世界品质"认证——数智化转型网 美通社新闻

WANPY顽皮®斩获WPA国际卓越奖,为中国宠粮首摘”世界品质”认证

拉斯维加斯2026年8月15日 /美通社/ — 2026年8月,WPA世界宠物协会(以下简称WPA […]
📅 08-27 · 👁 2026年8月27日
人工智能资讯-数字化转型网(专业造就领导者) 每日AI资讯

每日人工智能资讯|砸真金白银换来数千万用户!Perplexity印度大放送后迎来真正大考

人工智能初创公司 Perplexity 在过去一年里进行了一场全球AI行业备受瞩目的规模化增长实验。2025年 […]
📅 08-27 · 👁 2026年8月27日
人工智能资讯-数字化转型网(专业造就领导者) 每日AI资讯

每日人工智能资讯|宇树科技今日登陆科创板,开盘暴涨超600%

8月19日,科创板迎来宇树科技上市。公司此次发行4044.64万股,其中网上发行970.7万股,IPO首发价为 […]
📅 08-27 · 👁 2026年8月27日
人工智能资讯-数字化转型网(专业造就领导者) 每日AI资讯

每日人工智能资讯|Cursor推出Origin代码托管平台,正式进军GitHub核心领域

8月19日,已正式并入SpaceX的AI编程公司Cursor推出全新代码托管平台Origin,定位为GitHu […]
📅 08-27 · 👁 2026年8月27日
人工智能资讯-数字化转型网(专业造就领导者) 每日AI资讯

每日人工智能资讯|OpenAI 全面升级安全体系:吸取 Hugging Face 教训,前端模型审查最严

OpenAI 周二宣布一系列全新安全政策,重点防范模型测试期可能发生的安全事件。新规不仅强化开发过程中的监控, […]
📅 08-27 · 👁 2026年8月27日