NVIDIA Rubin GPU 公开架构 + 通用 GPU 设计/制造理论”整理为因素表。Rubin 公开资料偏数据中心 AI(算子/张量核/缓冲/HBM/3nm/chiplet/NV-HBI),渲染核在 Rubin AI SKU 中不是重点,因此渲染相关按 NVIDIA 通用图形子系统补充,标注“通用/若Rubin图形SKU”。
编号 | 类型 | 模块 | 属性 | 参数/类型/模式 | 数学建模和方程式 | 关联知识 |
|---|---|---|---|---|---|---|
1 | 算子/计算范式 | GEMM/Transformer 算子 | 精度、形状、K维吞吐 | NVFP4/FP8/BF16/FP16/TF32;M×N×K tile;Rubin 张量核每时钟K维吞吐较Blackwell翻倍,896 Tensor Core,最高50 PF NVFP4 | 峰值张量算力:PTC=NSMNTC/SMfWKαprec;GEMM迭代数 IK=⌈K/WK⌉,Rubin相对Blackwell IKRub/IKBwk≈1/2;实际利用 U=min(1,PTCT2MNK,2(M+N)KBWeffHBM)< |