加载中...

SIMT(Single Instruction, Multiple Threads,单指令多线程)是 NVIDIA 在 Tesla 架构中提出的 GPU 执行模型:硬件把线程按固定大小分组(NVIDIA 称 Warp,通常 32 线程;AMD 称 Wavefront),同组线程在同一时钟周期锁步执行同一条指令,但每个线程拥有独立的寄存器和访存地址。
SIMD 由程序员或编译器显式操作向量寄存器;SIMT 则让开发者以标量线程的视角编程,由硬件负责把线程打包成向量执行。这使 GPU 编程模型接近普通多线程代码,大幅降低了并行编程门槛。
当同一 Warp 内的线程在条件分支上走向不同路径时,硬件必须串行执行各条路径并用掩码屏蔽不活跃线程,称为分支发散(Branch Divergence),是 GPU 程序常见的性能瓶颈。
SIMT 是 CUDA、OpenCL 等 GPU 通用计算编程模型的硬件基础,理解它是编写高效 GPU 内核的前提。

登录 后参与讨论
暂无讨论,来发表第一条评论吧