用户名 密码 立即注册
设为首页收藏本站
搜索
第一家电网 门户 要闻 查看内容

英伟达已重启人工智能推理预填充加速 GPU "Rubin CPX" 项目

2026-9-1 14:27| 发布者: admin| 查看: 25690| 评论: 0|原作者: 溯波|来自: IT之家

摘要: 来源:IT之家 作者:溯波 责编:溯波IT之家 9 月 1 日消息,分析师郭明錤昨日表示,其最新产业调查显示 NVIDIA(英伟达)已重启人工智能推理预填充加速 GPU "Rubin CPX" 项目,不过其设计得到了大幅度的调整,预 ...
  来源:IT之家 作者:溯波 责编:溯波

  IT之家 9 月 1 日消息,分析师郭明錤昨日表示,其最新产业调查显示 NVIDIA(英伟达)已重启人工智能推理预填充加速 GPU "Rubin CPX" 项目,不过其设计得到了大幅度的调整,预计 2027Q1 开始生产。

  消息称英伟达重启推理预填充优化芯片 Rubin CPX 项目,设计大幅调整

  在芯片级别,新 Rubin CPX 拥有接近标准 Rubin GPU 的算力,预填充性能进一步提升,单体最高功耗同为 2300W,配备 168GB HBM4 内存(IT之家注:旧 Rubin CPX 为 128GB GDDR7,168GB 或指向 7×24GB 设计)。

  来到托盘与机架级别,8 颗新 Rubin CPX 构成 1 个计算托盘;8 个计算托盘构成 1 个机架模组,内部以 Spectrum-6 全铜以太网横向扩展 (Scale-out);新 Rubin CPX 采用独立的 MGX ETL 机架,每个机架包含 1~4 组机架模组,机架模组间横向扩展则是 Spectrum-6 + OSFP 光学方案。

  而在系统层面,NVIDIA 建议 Rubin CPX 与标准 Rubin 按 1:1 配对,Rubin CPX ETL 机架与 Vera Rubin NVL72 机架间采用基于以太网的 RDMA 连接。

  这位分析师评论称,目前的 AI 推理工作量中超过 50% 来自处理输入并建立相应的 KV Cache,新 Rubin CPX 能以更具弹性的部署方式与更低成本承接预填充负载;新 Rubin CPX 计算托盘具备 1.34TB HBM 内存,足以满足大多数长上下文预填充与 KV Cache 建立需求。

  《IT之家》原文链接:https://www.ithome.com/0/996/759.htm

鲜花

握手

雷人

路过

鸡蛋
合作伙伴
友情链接
网站简介| 新闻中心| 版权声明| 合作咨询| 我要投稿| 免责声明| 招聘启事| 联系我们| 隐私保护
总机:010-63510912; 咨询热线:13401051135; 客服QQ:1900713212
版权所有 第一家电网 工业和信息化部备案/许可证编号: 京ICP备12019733号-1

Archiver| Comsenz Inc.   

GMT+8, 2026-9-1 16:11 , Processed in 0.024762 second(s), 16 queries .

Powered by Discuz! X2

© 2001-2011 Comsenz Inc.

回顶部