← 返回 2026-07-26 简报

NVIDIA 发布 Blackwell Ultra GPU:AI 训练速度翻倍

NVIDIA 正式发布了 Blackwell Ultra GPU,这是其下一代 AI 加速器架构,标志着 AI 计算能力的又一次飞跃。

规格亮点

  • 制造工艺:采用改进的 3nm 工艺,晶体管密度相比 4nm 提升 30%。芯片面积约 1000mm²,集成超过 2000 亿个晶体管。
  • 算力表现:FP8 算力达到 5 PFLOPS,相比前代 Hopper H100 提升 4 倍。FP16 算力达到 2.5 PFLOPS。
  • 内存与带宽:配备 288GB HBM4 内存,内存带宽达到 12 TB/s,相比 H100 的 3.35 TB/s 提升了 3.6 倍。

架构创新

Blackwell Ultra 引入了多项新架构特性:

  • 第二代 Transformer Engine:原生支持 FP4 和 FP6 精度计算,在保持模型质量的前提下进一步提升性能。
  • 稀疏计算:硬件原生支持 2:4 结构化稀疏,在不损失准确率的情况下将有效算力翻倍。
  • NVLink 6:新的芯片间互连技术,提供 1.8 TB/s 的双向带宽,支持 576 GPU 的无阻塞全互联。

NVIDIA 表示 Blackwell Ultra 将于 2026 年第四季度开始出货,首批客户包括主要云服务提供商和大型 AI 公司。

原文链接: https://nvidia.com/blackwell-ultra

来源: TechCrunch AI

原文链接:https://nvidia.com/blackwell-ultra
来源:TechCrunch AI
以上内容由 AI 自动翻译,仅供参考。
← 返回简报