据Reuters、钜亨网报道,英伟达CEO黄仁勋在WAIC 2026期间公开演讲中确认,公司下一代AI芯片Rubin GPU将率先集成HBM4高带宽内存,单卡AI算力达到H100的5倍。Rubin架构采用台积电3nm制程,FP4精度算力达到28 PFLOPS。
英伟达同步推出Rubin NVL576机架级方案,单机架集成576颗Rubin GPU,整机AI算力达16 EFLOPS,相比GB200 NVL72提升25倍。Rubin NVL576将于2027年Q1进入客户验证阶段。Azure、AWS、Google Cloud、Oracle Cloud已提前签订Rubin架构优先采购协议。
与此同时,AMD MI400系列、谷歌TPU v7、AWS Trainium4也在同步推进。AWS新一代Trainium4已实现2 exaFLOPS密集FP4性能和2.8 PB/s内存带宽。Meta也宣布筹建”Meta Compute”云算力业务。业内分析,全球AI芯片市场已进入”NVIDIA+自研芯片+国产芯片”三足鼎立新阶段。