跳到主要内容
步芽

【极致中配】CUDA培训系列

系统讲解CUDA C编程与GPU并行优化,涵盖共享内存、原子操作、并发、性能分析、多进程服务与调试等实战主题。

难度
难度 4/5面向已具备C/C++基础的开发者,涉及GPU并行架构与底层优化
适合人群
有C/C++基础、需做GPU加速或高性能计算的开发者与工程师
前置要求
C/C++编程(CUDA基于C语言扩展,需熟练掌握指针与内存管理)、计算机体系结构(理解内存层次、线程与并行有助于优化)、并行计算基础(了解并发与同步概念)、线性代数(常见GPU计算负载背景,非强制)
课程规模
13 · 3209播放

主题覆盖

CUDA C基础共享内存基础性能优化原子操作与归约Warp Shuffle统一内存并发GPU性能分析协作组多线程与CUDA并发多进程服务MPSCUDA图与调试

课程大纲(13 讲)

  1. P1 · 01 CUDA C Basics62 分钟
  2. P2 · 02 CUDA Shared Memory51 分钟
  3. P3 · 03 CUDA Fundamental Optimization Part 165 分钟
  4. P4 · 04 CUDA Fundamental Optimization Part 265 分钟
  5. P5 · 05 Atomics Reductions Warp Shuffle75 分钟
  6. P6 · 06 Managed Memory87 分钟
  7. P7 · 07 Concurrency83 分钟
  8. P8 · 08 GPU Performance Analysis72 分钟
  9. P9 · 09 Cooperative Groups79 分钟
  10. P10 · 10 Multithreading and CUDA Concurrency16 分钟
  11. P11 · 11 CUDA Multi Process Service30 分钟
  12. P12 · 12 CUDA Debugging86 分钟
  13. P13 · 13 CUDA Graphs25 分钟

本课程卡由 AI 生成,可能存在误差,欢迎反馈。