数智化转型网 人工智能资讯 每日人工智能资讯|国产 GPU 也能跑万亿大模型:海光 DCU 适配 Kimi K3,896 专家并行不卡顿

每日人工智能资讯|国产 GPU 也能跑万亿大模型:海光 DCU 适配 Kimi K3,896 专家并行不卡顿

国产算力第一次把万亿参数级的模型稳稳托住了。海光信息宣布,已完成 Kimi K3在其 DCU 平台上的全栈适配与性能验证——这意味着,跑动这类庞然大物的,不再只是少数几款海外旗舰芯片。数智化转型网www.szhzxw.cn

海光 DCU 从底层算子一路优化到推理引擎,模型代码无需任何改动就能直接跑起来,迁移成本几乎压到零,开发者拿到算力即可上线部署,兼容性相当从容。针对 KDA 注意力与896专家组成的 MoE 架构,海光做了算子级的定制打磨;哪怕896个专家同时并行,在百万级上下文的重载场景下,推理依旧高效稳定,不会卡顿。数智化转型网www.szhzxw.cn

落到场景上,K3在海光 DCU 上能撑起长程智能体工程、视觉闭环创作乃至自主芯片设计这类前沿玩法,国产算力用户也终于能亲手跑通万亿级的开源模型。值得补一笔的是,月之暗面在发布 K3之前,便已联合海光与中科曙光完成了完整的兼容性调优:曙光基于海光 DCU 硬件栈,打通了 Kimi MoE 架构的分布式训练与多卡并行推理链路;海光 DCU 则靠底层硬件与软件栈的协同优化,在曙光8000集群上让长文本推理稳稳运行。数智化转型网www.szhzxw.cn

官方实测给出了一颗定心丸:国产卡的性能折损被控制在12% 以内,已经达到商用部署的门槛。当万亿模型与国产 GPU 之间的那道墙被推开一道缝,智能时代的算力版图,正悄悄挪动。数智化转型网www.szhzxw.cn

若您对人工智能感兴趣或为人工智能创始人,可添加数智化转型网小助手思思微信加入人工智能交流群。若您在寻找人工智能供应商,可联系数智化转型网小助手思思(17757154048,微信同号)

思思企微
思思企微

若您为人工智能服务商,可添加数智化转型网小助手Jasper,加入人工智能行业交流群。

鹿鸣企微
Jasper企微

声明:本文来自数智化转型网,版权归作者所有。文章内容仅代表作者独立观点,不代表数智化转型网立场,转载目的在于传递更多信息。如有侵权,请联系我们。

底部图片
免责声明: 本网站(http://www.szhzxw.cn/)内容主要来自原创、合作媒体供稿和第三方投稿,凡在本网站出现的信息,均仅供参考。本网站将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。本网站对有关资料所引致的错误、不确或遗漏,概不负任何法律责任。 本网站刊载的所有内容(包括但不仅限文字、图片、LOGO、音频、视频、软件、程序等) 版权归原作者所有。任何单位或个人认为本网站中的内容可能涉嫌侵犯其知识产权或存在不实内容时,请及时通知本站,予以删除。https://www.szhzxw.cn/135287.html
2
标签:
联系我们

联系我们

17717556551

邮箱: editor@cxounion.org

关注微信
微信扫一扫关注我们

微信扫一扫关注我们

关注微博
返回顶部