开云(中国大陆官方网站)Kaiyun科技股份有限公司 - 领先的GPU计算与AI算力解决方案

关闭菜单
027-83317177
当前位置: 首页 > 新闻资讯 > 公司新闻

NVIDIA官宣新GPURubinCPX!多达128GB显存、推理性能高达百万token

2025-09-11 12:43:24 小编

  

NVIDIA官宣新GPURubinCPX!多达128GB显存、推理性能高达百万token

  我们知道,NVIDIA下一代GPU架构代号“Rubin”,明年才会正式登场。

  但是现在,NVIDIA官方宣布了“Rubin CPX”,一款专门面向长窗口AI推理、智能体工作负载而打造的上下文处理型GPU。

  它基于Rubin架构,单芯片设计,CUDA核心数量没公布,只是说配备四个NVENC编码器、四个NVDEC解码器用于视频工作流,搭配128GB GDDR7显存。

  NVIDIA宣称,它在NVFP4数据精度下,计算性能最高30 PFlops(每秒3亿亿次),可以实现百万级token的推理。

  同时,在长上下文处理场景下,它的注意力性能相比GB300 NVL72提升了最高3倍。

  Rubin CPX今天只是纸面宣布,正式推出要等到2026年底你没看错,是明年底。

  NVIDIA日前透露,下代Rubin GPU、Vera CPU都已经在台积电完成流片,符合预期。

联系专业的商务顾问,制定方案,专业设计,一对一咨询及其报价详情
服务热线服务热线 027-83317177
咨询kaiyun全站解决方案 马上咨询
免费获取技术咨询服务
姓名图标
电话图标
QQ图标

联系我们 contact us
027-83317177