技术博客

沉淀 AI 算力、无损网络、高速互联、集群验收和 AIDC 工程实践,帮助团队更快识别问题、验证方案和复用经验。

如何利用跨区域网络将分布式数据中心连接成大型 AI 工厂
技术文章

如何利用跨区域网络将分布式数据中心连接成大型 AI 工厂

AI 技术日益复杂,训练与推理领域的新进展对数据中心提出了更高的要求。随着数据中心算力的迅速提升,数据中心基础设施逐渐受到了和算法和模型无关的基础物理条件的

查看详情
InfiniBand:高性能存储网络的关键基石
技术文章

InfiniBand:高性能存储网络的关键基石

在AI和高性能计算领域,存储系统的带宽和并行处理能力已成为影响整体计算性能的关键瓶颈。随着NVIDIA推出新一代Blackwell和Rubin GPU

查看详情
南北向网络:加速企业 AI 工作负载的关键
技术文章

南北向网络:加速企业 AI 工作负载的关键

在 AI 基础架构中,数据为计算引擎提供关键燃料。随着代理式 AI 系统的持续演进,多个模型与服务相互协作,需要获取外部上下文并实时做出决策,企业面临如何高效、

查看详情
NVIDIA Jetson Thor,专为物理 AI 打造的卓越平台
技术文章

NVIDIA Jetson Thor,专为物理 AI 打造的卓越平台

机器人技术正经历一场变革,逐步脱离专用机器时代,迈入通用机器人时代。这一转变意味着机器人不再局限于单一用途、功能固定的形态,而是向更具备适应性的机器人演进,以

查看详情
NVIDIA DGX Spark:点燃 AI 通识教育新引擎
技术文章

NVIDIA DGX Spark:点燃 AI 通识教育新引擎

在人工智能飞速发展的今天,AI技术已渗透到社会的方方面面,成为推动各行业变革的核心力量。然而,当前人工智能领域人才缺口巨大,国内总缺口达500万,上海市 202

查看详情
利用 CPO 技术扩展 AI 工厂,提高能效
技术文章

利用 CPO 技术扩展 AI 工厂,提高能效

随着 AI 重新定义计算格局,网络已成为构建未来数据中心发展的关键支柱。大语言模型的训练性能不仅取决于计算资源,更受到底层网络敏捷性、容量和智能程度的影响。

查看详情
AI 算力下的光模块革命:Scale-Up 与 Scale-Out 需求拆解与CPO技术
技术文章

AI 算力下的光模块革命:Scale-Up 与 Scale-Out 需求拆解与CPO技术

当大模型参数突破万亿、AI集群规模迈向10万卡级,算力基础设施正面临一场“架构风暴”——Scale-Up(纵向扩

查看详情
NVIDIA DGX Spark发售前的终极解答,11个问题消除你的决策疑虑!
技术文章

NVIDIA DGX Spark发售前的终极解答,11个问题消除你的决策疑虑!

1. DGX Spark是什么?   NVIDIA DGX Spark 属于专为AI时代打造的一款桌面级AI超级计算机,从

查看详情
全面梳理FP8与FP4不同精度训练推理技术与应用
技术文章

全面梳理FP8与FP4不同精度训练推理技术与应用

随着今年Deepseek的爆火出圈,很多概念被大众广泛熟知,例如模型精度,模型精度是衡量机器学习模型性能的重要指标之一,不同的精度类型和评估指标可以帮助我们更全

查看详情