技术博客
沉淀 AI 算力、无损网络、高速互联、集群验收和 AIDC 工程实践,帮助团队更快识别问题、验证方案和复用经验。

借助 NVIDIA DOCA 2.5 提供高效、高性能的 AI 云
与 NVIDIA 交换机、BlueField DPU 和 SuperNIC 一起,DOCA 2.5 也是为支持要求严苛的 AI 工作负载而构建共同设计平台的重要

大模型时代的NVIDIA网络计算
在生成式AI里面,可以用NVLink,也可以用InfiniBand,但是在生成式AI云上面,还要提供一些云的服务,所以会有一些用户比较倾向于用以太网。NVIDI

NVIDIA 200G HDR Splitter H-Cable使用场景及应用优势
NVIDIA 200G HDR Splitter H-Cable这款线缆通过更好的方式去解决spine交换机和leaf交换机之间的端口连接问题,极大提升了IB交

DGX服务器集群架构系统为高性能网络提供超强性能
DGX 服务器集群架构的关键硬件需求对于实现高算力的AI训练和科学计算至关重要。不同型号的DGX 服务器配备不同的硬件组件,以满足高算力需求和网络通信要求。从服

适用于数据中心和 AI 时代的网络
NVIDIA Quantum InfiniBand 凭借超低延时、可扩展性能和先进的功能集,成为 AI 工厂的理想选择。而 NVIDIA Spectrum-X

BlueField-3 DPU:助攻企业大幅提升AI大语言模型训练性能
NVIDIA BlueField-3 DPU 可以提升整个网络性能,配合高算力 GPU ,可以支撑更大规模的大语言模型训练,从而缩短训练时间。根据模型需求动态调

InfiniBand网络是如何实现加速计算的?
基于InfiniBand网络为基础的集群架构方案,不仅可以提供更高带宽的网络服务,同时也降低了网络传输负载对计算资源的消耗,降低了延时,又完美地将HPC与数据中

NVIDIA Quantum-2赋能超算上云,跨入新高度
凭借每秒400 Gbps的高吞吐量,NVIDIA Quantum-2 InfiniBand将网速提高了一倍,网络端口数量增加了三倍。它在性能提升3倍的同时,还将

GPU集群采用InfiniBand还是RoCE组网
在GPU小集群规模内,可以采用IB或者RoCE网络,两者各有优缺点,根据实际的资金和技术积累来选择,而且RoCE网络内端到端尽量控制在3-5跳以内。对于超过万卡

