Nvidia
NVIDIA AI 超算网络综合实战(NCP-AIN)
介绍 NVIDIA AI 超算网络技术体系,重点讲解 RDMA、RoCE、InfiniBand、NVMe-oF 等高性能网络与存储访问技术,并基于物理真机环境开展 AI 分布式训练与推理实践。
10项目录
1条录像
进入课程
介绍 NVIDIA AI 超算网络技术体系,重点讲解 RDMA、RoCE、InfiniBand、NVMe-oF 等高性能网络与存储访问技术,并基于物理真机环境开展 AI 分布式训练与推理实践。
面向 NVIDIA AI 基础设施入门,介绍算力底座、基础运维和智能运维相关知识,帮助学员建立 AI 数据中心基础组件与运维流程的整体认知。课程目录可参考原始链接中的配套资料。
从零构建企业级 AI 基础设施与大模型生产线,覆盖网络、容器、Kubernetes、GPU 集群、镜像供应、数据存储、模型训练、评估、分布式推理、性能优化与可观测性。课程兼顾 NVIDIA 官方方案与开源技术路线,强调可落地、可复现的 AI 全栈实战能力。