Study note
What happens when you run a CUDA kernel
Properties
- Type
- Blogs
- Status
- 待读
- Domain
- AI / ML
- Category
- GPU、CUDA 与内核优化
- Source
- fergusfinn.com
- Vault note
library/articles/ai_ml/What-happens-when-you-run-a-CUDA-kernel-322c84c46bbaa5c0.md
Summary
Fergus Finn 的长文从一个 vector add kernel 出发,追踪 `nvcc` 如何生成 PTX/SASS/fatbin、host launch stub 如何打包参数、CUDA runtime/driver 如何通过 pushbuffer、GPFIFO、QMD 和 doorbell 把任务交给 GPU,再一路讲到 work distributor、SM、warp 调度和指令执行。
Highlights
很适合把 `<<<grid, block>>>`、PTX/SASS、driver launch、QMD、SM/warp 这些平时分散的概念串成一条真实执行路径,对读 vLLM/TensorRT-LLM 的 kernel 调用链和 profiling 结果很有帮助。
Notes
CUDA kernel launch 从编译到执行的底层全链路解析。
Comments
Loading comments...