AI推理芯片市场正在经历一场激烈的变革,硬件厂商之间的合作与生态构建变得愈发重要。近日,专注于AI推理领域的芯片初创公司 d-Matrix 宣布了一项重大战略举措:该公司将采用 NVIDIA 的 NVLink Fusion 技术,将其下一代 Raptor XPU 与 NVIDIA 的 AI 基础设施平台进行深度集成。这一合作标志着 d-Matrix 正式加入 NVIDIA 的生态系统,旨在为数据中心提供更高效、更灵活的机架级 AI 计算解决方案。
d-Matrix 作为一家新兴的 AI 推理芯片企业,一直致力于通过创新的架构设计来降低大模型推理的成本与功耗。其 Raptor XPU 是基于该公司独特的 DynaMIC(动态模拟计算)架构构建的,这种架构设计能够在保持高性能的同时,有效应对日益增长的实时 AI 推理需求。此次选用的 NVLink Fusion,是 NVIDIA 推出的一项关键的互连技术,它允许不同厂商的加速器能够无缝地接入 NVIDIA 的软件栈和硬件平台。
通过 NVLink Fusion,d-Matrix 的 Raptor XPU 将能够与 NVIDIA 的 MGX(模块化 GPU 框架)机架架构以及 Spectrum-X 网络生态系统进行高速互联。这意味着,数据中心在部署 d-Matrix 的 Raptor XPU 时,无需从头构建复杂的底层网络协议栈,而是可以直接利用 NVIDIA 现有的、经过大规模验证的 AI 基础设施。NVLink Scale-Up 技术将确保 XPU 之间具备极高的带宽和低延迟,这对于需要大规模并行计算的场景至关重要,例如同时处理多个并发用户的生成式 AI 服务。
这一合作对于行业的影响是深远的。首先,它打破了单一硬件供应商的封闭生态壁垒,通过开放互连技术,促进了异构计算环境的普及。对于云服务提供商和大型企业而言,这提供了更多的硬件选择空间,允许他们根据具体的业务负载(如视频编解码、自然语言处理)来灵活组合不同架构的加速器,从而优化整体成本效益比。其次,NVIDIA 通过引入 d-Matrix 等合作伙伴,进一步巩固了其在 AI 基础设施领域的统治地位,同时也为其他初创公司提供了进入大型企业市场的捷径。
在应用场景方面,这种机架级的集成部署方案具有极高的实用价值。随着大语言模型(LLM)的规模不断膨胀,传统的单卡或双卡推理方案已难以满足高并发、低延迟的业务需求。d-Matrix Raptor XPU 与 NVIDIA 平台的结合,使得开发者能够在 MGX 机架中构建一个高度优化的推理集群。这不仅简化了部署流程,还极大地提升了数据吞吐量。例如,在智慧安防、实时视频分析和云端游戏等对延迟敏感的领域,这种无缝集成的硬件方案能够提供更稳定的性能输出。
此外,NVLink Fusion 的加入也为软件层面的优化提供了可能。开发者可以继续沿用 CUDA 等成熟的开发工具,针对 d-Matrix 的 Raptor XPU 进行算法加速。这种“硬件即插即用”的体验,将大大降低企业采用新硬件的门槛。对于 d-Matrix 来说,这是其技术产品化、商业化进程中的关键一步;而对于 NVIDIA,这则是其生态战略的又一重要拼图,证明了其平台能够兼容多样化的创新硬件。
综上所述,d-Matrix 与 NVIDIA 的此次合作,不仅仅是两家公司的技术对接,更是 AI 硬件行业走向开放协作的一个缩影。随着 Raptor XPU 通过 NVLink Fusion 融入 NVIDIA 的 MGX 机架,我们有理由期待看到更多针对特定场景的、高能效比的 AI 推理解决方案涌现,为整个人工智能产业的落地应用提供更坚实的算力支撑。
信息来源:NVIDIA Blog,原文链接:https://blogs.nvidia.com/blog/d-matrix-nvlink-fusion/
封面图片来源:Unsplash / 摄影师 Thufeil M
