【NVIDIA官宣新GPU Rubin CPX】今天,NVIDIA官方宣布了“Rubin CPX”,一款专门面向长窗口AI推理、智能体工作负载而打造的上下文处理型GPU。它基于Rubin架构,单芯片设计,CUDA核心数量没公布,只是说配备四个NVENC编码器、四个NVDEC解码器用于视频工作流,搭配128GB GDDR7显存。NVIDIA宣称,它在NVFP4数据精度下,计算性能最高30 PFlops(每秒3亿亿次),可以实现百万级token的推理。同时,在长上下文处理场景下,它的注意力性能相比GB300 NVL72提升了最高3倍。不过,Rubin CPX今天只是纸面宣布,正式推出要等到2026年底。