title: 【CUDA 基础】5.3 减小全局内存访问
categories:
- CUDA
- Freshman
tags:
- 共享内存
- 归约
toc: true
date: 2018-06-04 19:47:29
Abstract: 本文介绍使用共享内存进行归约,并比较全局内存归约与共享内存归约之间的性能差距
Keywords: 共享内存,归约性能
开篇废话
逻辑是很是重要的,一旦你学会了逻辑,不少假的东西你能够轻松的识别出来,这会使你更增强大而不会被任何人或者组织洗脑。
废话少说,开始今天的博客。
使用共享内存的主要缘由就是减小对全局内存的访问,来减小没必要要的延迟,第三章咱们学过了归约,能够参考:spa
这两篇博客包含咱们前面使用全局内存进行归约的各类技术,咱们几天也要用其中一部分代码做为比较,来体现咱们共享内存的优点。
咱们要集中解决下面两个问题:线程
- 如何从新安排数据访问模式以免线程束分化
- 如何展开循环以保证有足够的操做使指令和内存带宽饱和
本文咱们经过对比研究前面的部分代码,来分析为什么要使用共享内存,以及如何使用共享内存。3d