数智化转型网szhzxw.cn 人工智能资讯 人工智能资讯|Nvidia 发布全新 Rubin CPX GPU,助力 “海量上下文” 人工智能应用

人工智能资讯|Nvidia 发布全新 Rubin CPX GPU,助力 “海量上下文” 人工智能应用

Nvidia 近日宣布,其全新的 Vera Rubin 微架构正处于研发阶段,计划于2026年正式推出。该架构下的 Rubin CPX 变体将专注于满足那些需要处理海量上下文窗口的人工智能工作负载。Nvidia 首席执行官黄仁勋在新闻发布会上表示:“Vera Rubin 平台将标志着人工智能计算的新飞跃,推出下一代 Rubin GPU 和名为 CPX 的新类别处理器。”

Rubin CPX 特别适用于需要处理超过一百万个 token 的应用场景,例如复杂的软件开发和高清晰度视频生成。根据 Nvidia 的计划,Vera Rubin NDL144CPX 类 GPU 将于2026年底上市。CPX 模型是针对需要长上下文窗口的应用而特别设计的,能够提供8exaflops 的人工智能性能、30PF NVFP4的上下文计算能力,以及相较于 Nvidia GB300NVL72系统提升了三倍的指数运算能力。此外,CPX 模型还配备了128GB GDDR7内存、4个编码器和4个解码器,专为生成视频而设计,并提供100TB 的快速内存。

Nvidia 的高管表示,Vera Rubin NDL144CPX 可被视为大型人工智能工厂的一部分。为了支持大规模数据中心的构建,Nvidia 还计划推出千兆规模的参考设计。这意味着,Nvidia 将与基础设施公司密切合作,从计算的角度重新设计数据中心,以提供覆盖建筑、设计、模拟、运营等各个方面的参考设计。

在此次发布前,Nvidia 还公布了最新的 MLPerf 推理测试结果,黑威尔 GPU 在该基准测试中创下了新记录,超越了 Llama3.1405B 交互模型的基线。此项创新技术被称为 “解耦服务”,能够使相同硬件在性能上得到提升,这为已经部署解决方案的企业带来了额外的收入机会。

声明:本文来自网络,版权归作者所有。文章内容仅代表作者独立观点,不代表数字化转型网立场,转载目的在于传递更多信息。如有侵权,请联系我们。

本文由数字化转型网(www.szhzxw.cn)转载而成,来源于网络;编辑/翻译:数字化转型网(Professionalism Achieves Leadership 专业造就领导者)萍水

免责声明: 本网站(http://www.szhzxw.cn/)内容主要来自原创、合作媒体供稿和第三方投稿,凡在本网站出现的信息,均仅供参考。本网站将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。本网站对有关资料所引致的错误、不确或遗漏,概不负任何法律责任。 本网站刊载的所有内容(包括但不仅限文字、图片、LOGO、音频、视频、软件、程序等) 版权归原作者所有。任何单位或个人认为本网站中的内容可能涉嫌侵犯其知识产权或存在不实内容时,请及时通知本站,予以删除。https://www.szhzxw.cn/93201.html
联系我们

联系我们

17717556551

邮箱: editor@cxounion.org

关注微信
微信扫一扫关注我们

微信扫一扫关注我们

关注微博
返回顶部