Characterizing Warp Divergence from Pascal to Blackwell4 days agohttps://arxiv.org/abs/2607.23402自Volta的独立线程调度以来,NVIDIA GPU以固定方式处理warp分歧的假设已在Ampere、Hopper和Blackwell GPU上进行了测试,并以Pascal作为基线。在所有测试的世代中,分歧路径随路径数量线性序列化(T(k) ≈ sk),没有超线性重收敛惩罚。Warp执行效率按32/k下降,惩罚与占用率无关,预测消除了序列化开销。相同的性能成本模型早于ITS,因为它出现在Pascal上。更多...