NVIDIA 正式发布了 Blackwell Ultra GPU,这是其下一代 AI 加速器架构,标志着 AI 计算能力的又一次飞跃。
规格亮点
- 制造工艺:采用改进的 3nm 工艺,晶体管密度相比 4nm 提升 30%。芯片面积约 1000mm²,集成超过 2000 亿个晶体管。
- 算力表现:FP8 算力达到 5 PFLOPS,相比前代 Hopper H100 提升 4 倍。FP16 算力达到 2.5 PFLOPS。
- 内存与带宽:配备 288GB HBM4 内存,内存带宽达到 12 TB/s,相比 H100 的 3.35 TB/s 提升了 3.6 倍。
架构创新
Blackwell Ultra 引入了多项新架构特性:
- 第二代 Transformer Engine:原生支持 FP4 和 FP6 精度计算,在保持模型质量的前提下进一步提升性能。
- 稀疏计算:硬件原生支持 2:4 结构化稀疏,在不损失准确率的情况下将有效算力翻倍。
- NVLink 6:新的芯片间互连技术,提供 1.8 TB/s 的双向带宽,支持 576 GPU 的无阻塞全互联。
NVIDIA 表示 Blackwell Ultra 将于 2026 年第四季度开始出货,首批客户包括主要云服务提供商和大型 AI 公司。
原文链接: https://nvidia.com/blackwell-ultra
来源: TechCrunch AI