NVIDIA Blackwell Ultra在AI模型训练性能上创世界纪录
NVIDIA宣布其Blackwell Ultra GPU在预训练DeepSeek-V3 671B模型时达到1,648 TFLOPs,创下世界新纪录,性能是上一代的三倍,得益于设计和软件优化的创新。

发生了什么
NVIDIA在其官方推特账号发布消息称,其新款图形处理器Blackwell Ultra GPU在预训练拥有6710亿参数(671B)的人工智能模型DeepSeek-V3时,创下了性能世界纪录。该GPU单元实现了1,648 TFLOPs的性能,约为其上一代AI硬件性能的三倍。这一突破得益于硬件与软件的极致协同设计及持续优化。
与此同时,英特尔强调了其在半导体行业中的角色,提到其设计并制造用于专门AI数据中心的CPU和先进封装。此外,公司通过Intel Foundry运营自有工厂,是少数美国先进芯片制造商之一,这对AI技术的发展和采用的关键基础设施提供了重要支持。
为什么重要
NVIDIA在Blackwell Ultra GPU性能上的成就是AI基础设施的重要里程碑,尤其是在训练如DeepSeek-V3这样的大规模基础模型方面。处理能力的提升加快了开发和创新周期,使得训练更加高效和复杂,能够生成更强大、更精准的模型。
同样,英特尔作为先进芯片制造商及其在美国的制造基础设施,强化了AI技术发展的关键供应链。先进半导体的本地生产能力有助于缓解国际依赖问题,确保高性能AI硬件开发的连续性。
这两项进展凸显了硬件与软件在AI生态系统中协同进化的重要性,芯片性能和软件优化是支撑基础模型能力指数增长的关键因素。
尚待确认的事项
根据现有发布信息,尚无关于Blackwell Ultra GPU内部架构的具体技术细节,也未公布其何时面向客户商业发售及价格信息。也未有关于NVIDIA与英特尔之间明确合作或其开发成果如何整合到AI基础设施联合解决方案中的信息。
## 来源 - NVIDIAAI. https://x.com/NVIDIAAI/status/2079582939373863353 - Solana. https://x.com/Solana/status/2079561569932083390
*本报道基于科技公司官方账号的公开发布内容,信息需进一步核实,不构成财务建议或市场预测。*