← 返回信息流
模型 IT之家 2026-09-01 01:42 🔥 热度 3

消息称英伟达重启推理预填充优化芯片 Rubin CPX 项目,设计大幅调整

英伟达重启推理优化芯片Rubin CPX项目

IT之家 9 月 1 日消息,分析师郭明錤昨日表示,其最新产业调查显示 NVIDIA(英伟达)已重启人工智能推理预填充加速 GPU "Rubin CPX" 项目 ,不过其设计得到了大幅度的调整,预计 2027Q1 开始生产。 在芯片级别, 新 Rubin CPX 拥有接近标准 Rubin GPU 的算力 , 预填充性能进一步提升 ,单体最高功耗同为 2300W, 配备 168GB HBM4 内存 (IT之家注:旧 Rubin CPX 为 128GB GDDR7,168GB 或指向 7×24GB 设计)。 来到托盘与机架级别,8 颗新 Rubin CPX 构成 1 个计算托盘;8 个计算托盘构成 1 个机架模组,内部以 Spectrum-6 全铜以太网横向扩展 (Scale-out);新 Rubin CPX 采用独立的 MGX ETL 机架,每个机架包含 1~4 组机架模组,机架模组间横向扩展则是 Spectrum-6 + OSFP 光学方案。 而在系统层面, NVIDIA 建议 Rubin CPX 与标准 Rubin 按 1:1 配对 ,Rubin CPX ETL 机架与 Vera Rubin NVL72 机架间采用基于以太网的 RDMA 连接。 这位分析师评论称,目前的 AI 推理工作量中超过 50% 来自处理输入并建立相应的 KV Cache,新 Rubin CPX 能以更具弹性的部署方式与更低成本承接预填充负载;新 Rubin CPX 计算托盘具备 1.34TB HBM 内存,足以满足大多数长上下文预填充与 KV Cache 建立需求。

查看原文 ↗ 硬件算力大模型发布

📌 相关阅读

Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1:编程基准翻倍,缓存读取成本直降 75% 热度 22 GPT-6 热度 12 拆开优必选萌UU: 大模型 不在机身里,它的 AI 到底在哪里?| AI 玩具拆解04 热度 9 Gemini 3.8 flash 或携手 GPT-Astra 明天发布;Grok 10 天后发布【09-02 AI 资讯】 热度 9 性能暴涨20%!Claude Fable 5.1上手评测+性能解读!微意图对齐能力升级+Agent性能再涨20%+提示缓存降价75%,最强 模型 实现自我超越! 热度 9