18.3.2 内存访问优化#

在 GPU 架构中,大规模并行计算单元共享有限的内存总线带宽;尽管 GPU 拥有数千个计算核心,但数据从显存传输到计算单元的速度常常成为制约整体吞吐量的关键因素。

登录后才可看