第二卷 · 硬件与算力
软件层的每一个性能数字最终都要落到硬件的带宽与容量上。本卷讲清楚现代加速器”快在哪里、慢在哪里”,为后续内核、并行与推理各卷提供硬件直觉。
- 第一部分 · 加速器:GPU 架构:SM、Tensor Core 与 warp、内存层次与 HBM、加速器格局:GPU、TPU、ASIC 与国产芯片。
- 第二部分 · 节点与机房:节点内互连:NVLink、NVSwitch 与 PCIe、功耗、散热与机房约束。
第一卷。
软件层的每一个性能数字最终都要落到硬件的带宽与容量上。本卷讲清楚现代加速器”快在哪里、慢在哪里”,为后续内核、并行与推理各卷提供硬件直觉。
第一卷。