AI Infrastructure Knowledge Hub

FAQ / AI 服务器

4 个条目

AI 服务器4
FAQ

八张 GPU 为什么不是八倍算力?多卡扩展效率、通信与拓扑怎么理解

GPU 数量增加并不意味着训练或推理性能按卡数线性增长。本文从并行方式、通信开销、NVLink/PCIe 拓扑、NCCL、CPU 与 I/O、Batch 和模型规模出发,解释多 GPU 扩展效率为什么会下降,以及怎样判断 2 卡、4 卡、8 卡是否真正有价值。

AI 服务器 2026-09-02
多GPU8卡服务器GPU扩展效率NCCL
FAQ

大模型推理为什么会卡在存储?模型加载、数据通路与并发服务怎么理解

大模型推理不只是 GPU 计算问题。模型权重加载、多个模型切换、RAG 数据、缓存、Offload 和共享存储都可能进入数据路径。本文解释存储什么时候会影响推理、什么时候不会,并区分 GPU 显存、系统内存、NVMe 和共享存储各自负责什么。

AI 服务器 2026-09-02
大模型推理AI存储NVMeGPUDirect Storage
FAQ

AI服务器扩容路线:加GPU、加节点还是升级平台?

现有AI服务器算力不够时,先判断瓶颈在显存、计算、互联、PCIe、网络、存储还是机房,再决定加GPU、增加节点或升级整机平台,并通过扩容前后基线验证实际收益。

AI 服务器 2026-08-06
AI服务器扩容GPU服务器扩容GPU集群Scale-up
FAQ

PCIe通道不够会怎样影响多GPU服务器

PCIe通道不足可能使GPU、网卡和NVMe共享上行,影响数据搬运、跨卡通信和扩展效率。本文说明术语、敏感负载、拓扑资料和实机验证方法

AI 服务器 2026-07-20
PCIe通道多GPU服务器PCIe拓扑GPU P2P