PARALLEL
HORIZONS
学习版本
001
中文
EN
01
交互式 GPU 学习游戏
用并行
思考。
写一个程序,然后带着它穿越 GPU 的演进历史。观察机器如何执行,修改代码解决瓶颈,逐步理解一块芯片如何扩展成现代计算平台。
开始课程 00
↗
无需基础 · 预计 4 分钟
可编程
处理器
30 个单元
等待任务
线程就绪
000 / 256
当前模式
串行
主线任务
00 / 07
当前课程
把一个循环变成 256 个线程
研究主题
CPU 与 GPU
SM 结构
为什么是 CUDA?
00
可编程并行
历史锚点
2006–07 · G80 / CUDA
01
内存层次
历史锚点
2010 · FERMI 内存
02
任务并发
历史锚点
STREAMS → HYPER-Q
03
多 GPU 扩展
历史锚点
MULTI-GPU → P100 / NVLINK
04
张量计算
历史锚点
2017 · VOLTA / WMMA
05
资源隔离
历史锚点
2020 · AMPERE / MIG
06
Transformer 扩展
历史锚点
2022 · HOPPER / FP8
07
机架级推理
历史锚点
2024+ · BLACKWELL / NVL72
01
/
08
Parallel Horizons — Think in Parallel