技术博客

沉淀 AI 算力、无损网络、高速互联、集群验收和 AIDC 工程实践,帮助团队更快识别问题、验证方案和复用经验。

构筑AI工厂连接底座:超擎数智高密光纤方案赋能下一代AIDC建设
技术文章

构筑AI工厂连接底座:超擎数智高密光纤方案赋能下一代AIDC建设

查看详情。

查看详情
从800G迈向1.6T:下一代AI集群高速光互联全解析
技术文章

从800G迈向1.6T:下一代AI集群高速光互联全解析

查看详情。

查看详情
从模型训练到智能体推理:NVIDIA Vera CPU为何成为下一代AI基础设施关键一环
技术文章

从模型训练到智能体推理:NVIDIA Vera CPU为何成为下一代AI基础设施关键一环

当人工智能从生成式问答逐渐迈向自主规划、调用工具、编写代码、与环境交互的“智能体”时代。算力消耗的底层逻辑发生了根本性变化。大规模预训练虽然仍是AI能力的基石,但AI工作流的重心正在向推理侧的复杂循环倾斜。在这个新范式下,CPU正在从传统AI架构中的辅助角色,重新成为影响AI系统整体效率的重要组成部分。

查看详情
重磅解构 | 解锁Kimi K3极致性价比,超擎数智企业级本地大模型全栈解决方案实践
技术文章

重磅解构 | 解锁Kimi K3极致性价比,超擎数智企业级本地大模型全栈解决方案实践

随着大模型技术进入企业应用阶段,越来越多企业开始关注如何将AI能力真正融入自身业务流程。相比调用公网模型服务,私有化部署能够在数据安全、业务定制、服务稳定性等方面提供更强保障。但与此同时,企业也面临新的挑战

查看详情
NVIDIA CMX:跨越显存边界,重构智能体时代的“上下文记忆”
技术文章

NVIDIA CMX:跨越显存边界,重构智能体时代的“上下文记忆”

大模型的上下文窗口,正在从几十万Token迈向百万级甚至更长尺度。与之同步发生的,是AI应用范式的转变,从问答交互的聊天机器人,走向能够理解复杂目标、调用多种工具、拆解长期任务,并与其他智能体协同工作的Agentic AI。

查看详情
NVIDIA Spectrum-6 专为 Vera Rubin 打造,登陆十亿瓦级 AI 工厂
技术文章

NVIDIA Spectrum-6 专为 Vera Rubin 打造,登陆十亿瓦级 AI 工厂

作为新的网络里程碑产品,NVIDIA Spectrum-6 是一款 102.4T 的以太网交换机,其容量是上一代的 2 倍,为 NVIDIA Vera Rubin 平台构建,即将在全球的十亿瓦级 AI 工厂中落地。Spectrum-6 驱动新一代 NVIDIA Spectrum-X 以太网平台,为运营 AI 工厂端到端计算系统提供所需的高带宽、规模扩展和智能。

查看详情
WAIC展品抢鲜看 | 超擎数智CQIS服务,解锁AI算力底座的高效交付密码
技术文章

WAIC展品抢鲜看 | 超擎数智CQIS服务,解锁AI算力底座的高效交付密码

随着AI推理时代的发展,AI基础设施已成为企业构建核心竞争力的关键。然而,自主搭建GPU AI集群并非易事。在算力底座从0到1的落地过程中,许多企业正面临着搭建难、运营难的痛点。

查看详情
WAIC展品抢鲜看 | AI Driver Platform亮相:让AI持续创造业务价值
技术文章

WAIC展品抢鲜看 | AI Driver Platform亮相:让AI持续创造业务价值

人工智能正在进入从技术探索走向产业落地的新阶段。过去,企业建设AI的重点往往集中在“大模型部署”。但随着AI应用深入业务流程,企业逐渐发现:拥有一个模型,并不等于拥有真正的AI能力。 一次完整的AI服务,需要经历模型推理、知识检索、Agent决策、工具调用、数据库访问以及业务系统交互等多个环节。这些能力共同组成了一条完整的AI Workflow(AI 工作流),而Workflow的稳定运行,又依赖于GPU集群、模型服务、存储、网络以及调度系统等底层基础设施。

查看详情
携手英伟达 VAST Data 构建面向大规模 AI 的全新内存层级
技术文章

携手英伟达 VAST Data 构建面向大规模 AI 的全新内存层级

实际上,KV cache 已演变为长效内存,系统性能取决于 KV cache 的管理效率与上下文复用能力。推理上下文离 GPU 越远,推理成本就越高,

查看详情