Study note
TPU Deep Dive
Properties
- Type
- Blogs
- Status
- 待读
- Domain
- AI / ML
- Category
- 机器学习综合与实践
- Source
- henryhmko.github.io
- Vault note
library/articles/ai_ml/TPU-Deep-Dive-b67da3050b943b82.md
Summary
Henry Ko 的 TPU 深度文章,从 TPU 的设计动机、矩阵乘加速、systolic array、内存/带宽约束和软件栈视角解释专用 ML 加速器如何提升神经网络计算效率。
Highlights
适合作为 CUDA/GPU 之外的异构加速器补充材料,帮助理解为什么 AI inference 不只是“会写 GPU kernel”,还要理解算子、数据流和硬件架构之间的匹配。
Notes
TPU 架构、矩阵单元和 ML 加速器设计解析。
Comments
Loading comments...