NVIDIA官宣新GPU Rubin CPX!多达128GB显存、推理性能高达百万token

NVIDIA官宣新GPU Rubin CPX!多达128GB显存、推理性能高达百万token
2025年09月10日 12:11 快科技

快科技9月10日消息,128GB显存的RTX 5090是没有的,不过128GB显存的AI GPU确实有。

我们知道,NVIDIA下一代GPU架构代号“Rubin”,明年才会正式登场。

但是现在,NVIDIA官方宣布了“Rubin CPX”,一款专门面向长窗口AI推理、智能体工作负载而打造的上下文处理型GPU。

它基于Rubin架构,单芯片设计,CUDA核心数量没公布,只是说配备四个NVENC编码器、四个NVDEC解码器用于视频工作流,搭配128GB GDDR7显存。

NVIDIA宣称,它在NVFP4数据精度下,计算性能最高30 PFlops(每秒3亿亿次),可以实现百万级token的推理。

同时,在长上下文处理场景下,它的注意力性能相比GB300 NVL72提升了最高3倍。

Rubin CPX今天只是纸面宣布,正式推出要等到2026年底——你没看错,是明年底。

NVIDIA日前透露,下代Rubin GPU、Vera CPU都已经在台积电完成流片,符合预期。

【本文结束】如需转载请务必注明出处:快科技

责任编辑:上方文Q

NVIDIAGPU
新浪科技公众号
新浪科技公众号

“掌”握科技鲜闻 (微信搜索techsina或扫描左侧二维码关注)

创事记

科学探索

科学大家

苹果汇

众测

专题

官方微博

新浪科技 新浪数码 新浪手机 科学探索 苹果汇 新浪众测

公众号

新浪科技

新浪科技为你带来最新鲜的科技资讯

苹果汇

苹果汇为你带来最新鲜的苹果产品新闻

新浪众测

新酷产品第一时间免费试玩

新浪探索

提供最新的科学家新闻,精彩的震撼图片