🌀 AIBB-Flywheel

新闻数据飞轮
← 返回文章列表
ithome 科技 体育 采集 2026-09-01T04:13:32+00:00

英伟达重启Rubin CPX项目,2027年量产

原始标题:消息称英伟达重启推理预填充优化芯片 Rubin CPX 项目,设计大幅调整

来源
ithome
发布时间
2026-09-01T01:42:15
采集批次
2026-09-01-04
字数
614
URL 指纹
139eb0726cff4502

📌 AI 总结(213 字)

据分析师郭明錤透露,英伟达已重启AI推理预填充加速GPU「Rubin CPX」项目,并进行大幅设计调整。该芯片算力接近标准Rubin GPU,单颗功耗2300W,配备168GB HBM4内存,预计2027年一季度投产。8颗Rubin CPX组成一个计算托盘,8个托盘构成一个机架模组,英伟达建议与标准Rubin按1:1配对部署。该芯片针对AI推理中超过50%的输入处理与KV Cache建立负载,旨在以更低成本承接预填充任务。
📄 正文(614 字)
IT之家9月1日消息,分析师郭明錤昨日表示,其最新产业调查显示NVIDIA(英伟达)已重启人工智能推理预填充加速GPU「Rubin CPX」项目,不过其设计得到了大幅度的调整,预计2027年第一季度开始生产。

在芯片级别,新Rubin CPX拥有接近标准Rubin GPU的算力,预填充性能进一步提升,单体最高功耗同为2300W,配备168GB HBM4内存。旧版Rubin CPX采用128GB GDDR7,新版的168GB可能指向7×24GB的堆叠设计。

来到托盘与机架级别,8颗新Rubin CPX构成1个计算托盘;8个计算托盘构成1个机架模组,内部以Spectrum-6全铜以太网横向扩展(Scale-out);新Rubin CPX采用独立的MGX ETL机架,每个机架包含1至4组机架模组,机架模组间横向扩展则采用Spectrum-6与OSFP光学方案。

而在系统层面,NVIDIA建议Rubin CPX与标准Rubin按1:1配对,Rubin CPX ETL机架与Vera Rubin NVL72机架间采用基于以太网的RDMA连接。

这位分析师评论称,目前的AI推理工作量中超过50%来自处理输入并建立相应的KV Cache,新Rubin CPX能以更具弹性的部署方式与更低成本承接预填充负载;新Rubin CPX计算托盘具备1.34TB HBM内存,足以满足大多数长上下文预填充与KV Cache建立需求。