随着人工智能大模型技术的爆发式增长,算力的需求正呈现出指数级的上升趋势。在这一轮算力军备竞赛中,英伟达(NVIDIA)再次扮演了领跑者的角色。近日,NVIDIA 正式揭晓了其下一代 AI 芯片——Vera Rubin 的详细信息,并重点展示了其创新的机架级架构 NVL72。这款芯片不仅旨在追求更高的性能,更致力于通过优化能效比,为全球合作伙伴提供极具竞争力的推理成本。
核心亮点:NVL72 机架级架构
Vera Rubin 并非单一芯片的简单迭代,而是围绕“机架级”计算理念设计的完整解决方案。NVIDIA 推出的 NVL72 架构将 72 个 Vera Rubin GPU 集成在一个机架中。这种设计极大地简化了数据中心的建设流程。传统的超大规模集群部署需要复杂的线缆连接和庞大的散热系统,而 NVL72 通过内部的高速互联技术,实现了 GPU 之间的高效通信,从而大幅提升了算力的利用率和数据传输速度。
供应链与合作伙伴的全球布局
除了硬核的技术突破,Vera Rubin 的供应链建设同样令人瞩目。NVIDIA 宣布,Vera Rubin 的生产正在全面加速。目前,该芯片已开始在 CoreWeave、Google Cloud、Microsoft Azure 和 Oracle Cloud Infrastructure 等全球顶级云服务商的系统中进行部署。这标志着 Vera Rubin 已经跨越了实验室阶段,正式进入商业化落地期。
更令人印象深刻的是其供应链的成熟度。NVIDIA 表示,Vera Rubin 的供应链网络遍布全球 30 个国家的 350 多个工厂站点。这是迄今为止规模最大、成熟度最高的机架级供应链网络。如此庞大的基础设施网络,能够确保在全球范围内快速响应客户对算力的需求,为大规模 AI 应用的落地提供了坚实的硬件保障。
行业影响与未来展望
Vera Rubin 的推出,对于整个 AI 行业而言具有深远的意义。首先,它在性能与功耗之间找到了新的平衡点。随着 AI 模型参数的爆炸式增长,传统的算力单元往往面临巨大的能耗压力。Vera Rubin 强调的“每瓦性能”提升,意味着企业可以用更少的电力消耗获得更强大的算力支持,这对于推动绿色计算至关重要。
其次,最低的“代币成本”是 Vera Rubin 对开发者的核心承诺。在生成式 AI 的应用中,推理成本往往是限制模型普及的瓶颈。通过更高效的芯片架构,Vera Rubin 有望显著降低生成文本、图像和视频的成本,使得中小型企业也能负担得起高性能 AI 服务的费用。
综上所述,NVIDIA Vera Rubin 的发布,不仅是硬件层面的升级,更是算力基础设施模式的革新。从 NVL72 的机架级设计到全球化的供应链布局,NVIDIA 正在构建一个更加高效、经济的 AI 生态。随着各大云厂商的陆续接入,我们有理由相信,Vera Rubin 将成为推动下一代人工智能应用普及的关键引擎。
信息来源:NVIDIA Blog,原文链接:https://blogs.nvidia.com/blog/vera-rubin/