国产 GPU 也能跑万亿大模型:海光 DCU 适配 Kimi K3,896 专家并行不卡顿

国产算力第一次把万亿参数级的模型稳稳托住了。海光信息宣布,已完成 Kimi K3在其 DCU 平台上的全栈适配 […]

国产算力第一次把万亿参数级的模型稳稳托住了。海光信息宣布,已完成 Kimi K3在其 DCU 平台上的全栈适配与性能验证——这意味着,跑动这类庞然大物的,不再只是少数几款海外旗舰芯片。

海光 DCU 从底层算子一路优化到推理引擎,模型代码无需任何改动就能直接跑起来,迁移成本几乎压到零,开发者拿到算力即可上线部署,兼容性相当从容。针对 KDA 注意力与896专家组成的 MoE 架构,海光做了算子级的定制打磨;哪怕896个专家同时并行,在百万级上下文的重载场景下,推理依旧高效稳定,不会卡顿。

落到场景上,K3在海光 DCU 上能撑起长程智能体工程、视觉闭环创作乃至自主芯片设计这类前沿玩法,国产算力用户也终于能亲手跑通万亿级的开源模型。值得补一笔的是,月之暗面在发布 K3之前,便已联合海光与中科曙光完成了完整的兼容性调优:曙光基于海光 DCU 硬件栈,打通了 Kimi MoE 架构的分布式训练与多卡并行推理链路;海光 DCU 则靠底层硬件与软件栈的协同优化,在曙光8000集群上让长文本推理稳稳运行。

官方实测给出了一颗定心丸:国产卡的性能折损被控制在12% 以内,已经达到商用部署的门槛。当万亿模型与国产 GPU 之间的那道墙被推开一道缝,智能时代的算力版图,正悄悄挪动。

CXOU AI 未来大会 · 报名通道限时开启
💬 评论
🔗 本文链接

📰 你可能也喜欢

数智化转型网每日AI资讯 资讯

ZCode 道歉并开源:阿里云 OSS 已清空,Repo Wiki 功能已下线

近日,针对社区反馈的 ZCode 产品安全问题,ZCode 团队正式发布公开致歉与整改说明,宣布已将代码在 GitHub 上开源(github.com/zai-…
📅 09-23 · 👁 2026年9月23日
数智化转型网每日AI资讯 AI新闻资讯

黄仁勋驳斥 AI 末日叙事:吓唬人不负责任,2030 年是世界末日概率为 0%

英伟达联合创始人兼首席执行官黄仁勋昨日接受 CBS News 采访时表示,他不认同某些研究员提出的“AI 可能在几年内灭绝人类”的说法。他认为这类说法属于被过度…
📅 09-23 · 👁 2026年9月23日
数智化转型网每日AI资讯 资讯

我国首款藏语多语言全模态 AI 输入法发布:覆盖手机电脑,支持三大方言语音输入

9 月 20 日在青海师范大学教师教育高质量发展暨建校 70 周年大会的科研成果展示环节,我国首款藏语多语言全模态 AI 输入法——智达 AI 输入法及配套藏文…
📅 09-23 · 👁 2026年9月23日
数智化转型网每日AI资讯 资讯

通义千问开源 Qwen-Image-2.1:7B 参数实现文生图与图像编辑一体化

9月21日,通义千问团队正式开源新一代图像模型 Qwen-Image-2.1。该模型以仅7B 参数的轻量视觉生成模块,将文生图、透明图像生成与多种图像编辑能力整…
📅 09-23 · 👁 2026年9月23日
数智化转型网每日AI资讯 资讯

OpenAI研究员放话"物理断网也拦不住 AI":BitWhisper 用 CPU 温度传信,每小时只能淌 8 个比特

OpenAI 和 Anthropic 前几日刚带头呼吁给 AI 研究"降速",理由是新模型越来越危险。而 OpenAI 研究员 Noam B…
📅 09-23 · 👁 2026年9月23日
数智化转型网每日AI资讯 资讯

腾讯推出“混元智囊团”专家平台,AI行业竞争转向外部人才生态

据《读佳》消息,腾讯旗下混元大模型近日正式推出面向外部行业人才的专家平台“混元智囊团”,平台Slogan为“聚智为谋,引领未来”。该平台旨在通过连接金融、法律、…
📅 09-23 · 👁 2026年9月23日