技术博客

沉淀 AI 算力、无损网络、高速互联、集群验收和 AIDC 工程实践,帮助团队更快识别问题、验证方案和复用经验。

借助 NVIDIA DOCA 2.5 提供高效、高性能的 AI 云
技术文章

借助 NVIDIA DOCA 2.5 提供高效、高性能的 AI 云

与 NVIDIA 交换机、BlueField DPU 和 SuperNIC 一起,DOCA 2.5 也是为支持要求严苛的 AI 工作负载而构建共同设计平台的重要

查看详情
大模型时代的NVIDIA网络计算
技术文章

大模型时代的NVIDIA网络计算

在生成式AI里面,可以用NVLink,也可以用InfiniBand,但是在生成式AI云上面,还要提供一些云的服务,所以会有一些用户比较倾向于用以太网。NVIDI

查看详情
NVIDIA 200G HDR Splitter H-Cable使用场景及应用优势
技术文章

NVIDIA 200G HDR Splitter H-Cable使用场景及应用优势

NVIDIA 200G HDR Splitter H-Cable这款线缆通过更好的方式去解决spine交换机和leaf交换机之间的端口连接问题,极大提升了IB交

查看详情
DGX服务器集群架构系统为高性能网络提供超强性能
技术文章

DGX服务器集群架构系统为高性能网络提供超强性能

DGX 服务器集群架构的关键硬件需求对于实现高算力的AI训练和科学计算至关重要。不同型号的DGX 服务器配备不同的硬件组件,以满足高算力需求和网络通信要求。从服

查看详情
适用于数据中心和 AI 时代的网络
技术文章

适用于数据中心和 AI 时代的网络

NVIDIA Quantum InfiniBand 凭借超低延时、可扩展性能和先进的功能集,成为 AI 工厂的理想选择。而 NVIDIA Spectrum-X

查看详情
BlueField-3 DPU:助攻企业大幅提升AI大语言模型训练性能
技术文章

BlueField-3 DPU:助攻企业大幅提升AI大语言模型训练性能

NVIDIA BlueField-3 DPU 可以提升整个网络性能,配合高算力 GPU ,可以支撑更大规模的大语言模型训练,从而缩短训练时间。根据模型需求动态调

查看详情
InfiniBand网络是如何实现加速计算的?
技术文章

InfiniBand网络是如何实现加速计算的?

基于InfiniBand网络为基础的集群架构方案,不仅可以提供更高带宽的网络服务,同时也降低了网络传输负载对计算资源的消耗,降低了延时,又完美地将HPC与数据中

查看详情
NVIDIA Quantum-2赋能超算上云,跨入新高度
技术文章

NVIDIA Quantum-2赋能超算上云,跨入新高度

凭借每秒400 Gbps的高吞吐量,NVIDIA Quantum-2 InfiniBand将网速提高了一倍,网络端口数量增加了三倍。它在性能提升3倍的同时,还将

查看详情
GPU集群采用InfiniBand还是RoCE组网
技术文章

GPU集群采用InfiniBand还是RoCE组网

在GPU小集群规模内,可以采用IB或者RoCE网络,两者各有优缺点,根据实际的资金和技术积累来选择,而且RoCE网络内端到端尽量控制在3-5跳以内。对于超过万卡

查看详情