【极致中配】CUDA培训系列
系统讲解CUDA C编程与GPU并行优化,涵盖共享内存、原子操作、并发、性能分析、多进程服务与调试等实战主题。
- 难度
- 难度 4/5 — 面向已具备C/C++基础的开发者,涉及GPU并行架构与底层优化
- 适合人群
- 有C/C++基础、需做GPU加速或高性能计算的开发者与工程师
- 前置要求
- C/C++编程(CUDA基于C语言扩展,需熟练掌握指针与内存管理)、计算机体系结构(理解内存层次、线程与并行有助于优化)、并行计算基础(了解并发与同步概念)、线性代数(常见GPU计算负载背景,非强制)
- 课程规模
- 13 讲 · 3209播放
主题覆盖
CUDA C基础共享内存基础性能优化原子操作与归约Warp Shuffle统一内存并发GPU性能分析协作组多线程与CUDA并发多进程服务MPSCUDA图与调试
课程大纲(13 讲)
- P1 · 01 CUDA C Basics62 分钟
- P2 · 02 CUDA Shared Memory51 分钟
- P3 · 03 CUDA Fundamental Optimization Part 165 分钟
- P4 · 04 CUDA Fundamental Optimization Part 265 分钟
- P5 · 05 Atomics Reductions Warp Shuffle75 分钟
- P6 · 06 Managed Memory87 分钟
- P7 · 07 Concurrency83 分钟
- P8 · 08 GPU Performance Analysis72 分钟
- P9 · 09 Cooperative Groups79 分钟
- P10 · 10 Multithreading and CUDA Concurrency16 分钟
- P11 · 11 CUDA Multi Process Service30 分钟
- P12 · 12 CUDA Debugging86 分钟
- P13 · 13 CUDA Graphs25 分钟
本课程卡由 AI 生成,可能存在误差,欢迎反馈。