英伟达偷偷重启Rubin CPX芯片!郭明錤曝五大变革:专攻百万Token推理、成本大降
最新9月1日消息,天风国际证券分析师郭明錤近日发布的最新产业调查显示,英伟达已重启Rubin CPX芯片计划,预计2027年第一季度正式投产。
这款专为大规模长上下文AI推理与预填充阶段设计的全新GPU类别,最早于2025年GTC大会首次公开,原计划2026年底上市,后一度从产品蓝图中移除,如今重新回归。
据郭明錤报告,重启后的新版CPX在规格、机柜设计、互联架构、运作模式和产品定位五个维度均有重大调整,整体朝着更灵活、更具成本效益的方向演进。
CPX是为了处理百万级Token的预填充及长上下文推理而设计的,采用NVFP4精度技术,单颗GPU提供30至50 Petaflops运算效能。旧版CPX原定搭载128GB GDDR7内存,成本更低但算力有限。
重启后的新版CPX改用168GB HBM4内存,低于Rubin标准版的288GB HBM4,但大幅高于旧版的128GB GDDR7。此外,单颗GPU最高功耗同为2300W。
机柜设计方面,新版CPX采用独立MGX ETL机柜,不再与Rubin共柜。客户可根据需求配置64、128、192或256颗CPX。每64颗CPX组成一个机柜模组,配置8个运算托盘(每托盘8颗CPX)加1个交换机托盘。
互联架构上,NVLink仅用于同一托盘内8颗CPX的Scale-Up互联,每颗CPX的NVLink带宽为1至1.5TB/s,低于Rubin的3.6TB/s。同一机柜模组内的托盘间通过Spectrum-6以太网进行Scale-Out,跨机柜模组则通过OSFP光纤连接。
CPX需与Vera Rubin NVL72搭配使用,英伟达建议CPX与Rubin的比例为1:1。CPX负责处理预填充并建立KV Cache,再通过以太网RDMA传输给Rubin执行解码生成。
郭明錤指出,目前AI推理工作负载中超过一半来自处理输入内容并建立KV Cache,CPX以更灵活的部署方式和更低成本承接这一任务,每个运算托盘(8颗CPX)约配备1.34TB HBM4,足以支撑大多数长上下文预填充与KV Cache建立需求。

《英伟达偷偷重启Rubin CPX芯片!郭明錤曝五大变革:专攻百万Token推理、成本大降》转载自互联网,如有侵权,联系我们删除,QQ:369-8522。
相关图文
-
不要灯效专注性能!芝奇推出Flare X5X内存:支持EXPO ULL超低延迟
快科技9月1日消息,芝奇正式推出Flare X5X系列DDR5内存,该系列支持AMD EXPO超低延迟技术,首发规格为32GB套装,由两根16GB内存模组组成。该系列内存的核心亮点在于支持AMD最新的EXPO ULL技术... -
国产长鑫内存接连重大突破!全球首家量产LPDDR6、HBM3E已开始试产
快科技9月1日消息,国产存储芯片制造商长鑫存储在一周之内,连续拿下LPDDR6、HBM3E两项重大突破。就在几天前,长鑫刚刚宣布LPDDR6内存量产,领先三星、SK海力士成为全球首家量产LPDDR6的厂商,... -
DDR5降价无望!存储短缺持续到2030年:内存高价将成常态
快科技9月1日消息,据报道,SK海力士CEO Kwak Noh-Jung在近日的美国新厂动工仪式上表示,当前看不到存储市场有任何下行迹象,存储短缺预计将持续到2030年底。SK海力士对内存市场的缓解时间点一... -
存储缺货无解!大厂70%产能锁死到2031年:HBM内存现货价飙涨至5倍
快科技9月1日消息,据韩国国际贸易协会发布的数据,韩国DRAM出口量从5月的约6.82亿片降到7月的5.92亿片,跌了13.2%,但出口额反倒从114.3亿美元涨到135.5亿美元,多了18.5%。算下来平均单价从... -
内存永远缺永远涨的新理由:机器人数据量200倍于AI 一年产生24PB
快科技9月1日消息,支撑当前内存价格大涨5-10倍的需求源于AI爆发,但三大内存巨头已经在为AI之后的时代造势了,那就是机器人,它一年产生的数据量会200倍于AI大模型。三星、SK海力士、美光之所...












