CUDA从入门到精通(四):加深对设备的认识
来源:互联网 发布:书法软件哪个最好 编辑:程序博客网 时间:2024/06/05 10:27
CUDA从入门到精通(四):加深对设备的认识
版权声明:本文为卜居原创文章,未经博主允许不得转载。卜居博客地址:http://blog.csdn.net/kkk584520
前面三节已经对CUDA做了一个简单的介绍,这一节开始真正进入编程环节。
首先,初学者应该对自己使用的设备有较为扎实的理解和掌握,这样对后面学习并行程序优化很有帮助,了解硬件详细参数可以通过上节介绍的几本书和官方资料获得,但如果仍然觉得不够直观,那么我们可以自己动手获得这些内容。
以第二节例程为模板,我们稍加改动的部分代码如下:
这个改动的目的是让我们的程序自动通过调用cuda API函数获得设备数目和属性,所谓“知己知彼,百战不殆”。
cudaError_t 是cuda错误类型,取值为整数。
cudaDeviceProp为设备属性结构体,其定义可以从cuda Toolkit安装目录中找到,我的路径为:C:\Program Files\NVIDIA GPU Computing Toolkit\CUDA\v5.0\include\driver_types.h,找到定义为:
后面的注释已经说明了其字段代表意义,可能有些术语对于初学者理解起来还是有一定困难,没关系,我们现在只需要关注以下几个指标:
name:就是设备名称;
totalGlobalMem:就是显存大小;
major,minor:CUDA设备版本号,有1.1, 1.2, 1.3, 2.0, 2.1等多个版本;
clockRate:GPU时钟频率;
multiProcessorCount:GPU大核数,一个大核(专业点称为流多处理器,SM,Stream-Multiprocessor)包含多个小核(流处理器,SP,Stream-Processor)
编译,运行,我们在VS2008工程的cudaGetDeviceProperties()函数处放一个断点,单步执行这一函数,然后用Watch窗口,切换到Auto页,展开+,在我的笔记本上得到如下结果:
可以看到,设备名为GeForce 610M,显存1GB,设备版本2.1(比较高端了,哈哈),时钟频率为950MHz(注意950000单位为kHz),大核数为1。在一些高性能GPU上(如Tesla,Kepler系列),大核数可能达到几十甚至上百,可以做更大规模的并行处理。
PS:今天看SDK代码时发现在help_cuda.h中有个函数实现从CUDA设备版本查询相应大核中小核的数目,觉得很有用,以后编程序可以借鉴,摘抄如下:
可见,设备版本2.1的一个大核有48个小核,而版本3.0以上的一个大核有192个小核!
前文说到过,当我们用的电脑上有多个显卡支持CUDA时,怎么来区分在哪个上运行呢?这里我们看一下addWithCuda这个函数是怎么做的。
使用了cudaSetDevice(0)这个操作,0表示能搜索到的第一个设备号,如果有多个设备,则编号为0,1,2...。
再看我们本节添加的代码,有个函数cudaGetDeviceCount(&num),这个函数用来获取设备总数,这样我们选择运行CUDA程序的设备号取值就是0,1,...num-1,于是可以一个个枚举设备,利用cudaGetDeviceProperties(&prop)获得其属性,然后利用一定排序、筛选算法,找到最符合我们应用的那个设备号opt,然后调用cudaSetDevice(opt)即可选择该设备。选择标准可以从处理能力、版本控制、名称等各个角度出发。后面讲述流并发过程时,还要用到这些API。
如果希望了解更多硬件内容可以结合http://www.geforce.cn/hardware获取。
- CUDA从入门到精通(四):加深对设备的认识
- CUDA从入门到精通(四):加深对设备的认识
- CUDA从入门到精通(四):加深对设备的认识
- CUDA从入门到精通到精通_笔记4:GPU设备属性查询的代码
- CUDA从入门到精通(转载)
- CUDA从入门到精通(精品)
- CUDA从入门到精通
- CUDA从入门到精通
- CUDA从入门到精通
- CUDA从入门到精通
- CUDA从入门到精通
- CUDA从入门到精通
- CUDA从入门到精通
- CUDA从入门到精通
- CUDA从入门到精通
- CUDA从入门到精通
- CUDA从入门到精通
- CUDA从入门到精通
- m啊弄 高频
- Android Studio JNI开发的环境配置 NDK
- CentOS7.0安装Nginx1.9.6
- JAVA反射系列之Field,java.lang.reflect.Field使用获取方法。
- CUDA从入门到精通(三):必备资料
- CUDA从入门到精通(四):加深对设备的认识
- 洛谷 P1265 公路修建
- chroot命令
- c++基础-虚函数
- 漫谈程序员系列:咦,你也在混日子啊
- [学习笔记]java并发编程目录
- 漫谈程序员系列:怎么告别“混日子”
- Java基础 - 3.运算符
- 外键约束的参照操作