cuda中各种类型的变量的总结(有转载的,有添加的)

来源:互联网 发布:淘宝如何免费推广 编辑:程序博客网 时间:2024/05/19 07:44
1 定义和使用全局变量
[cpp] view plaincopy
  1. 假设定义了全局变量 __device__ int *a;  

我需要一个数组,动态分配,那么直接调用cudaMalloc来为a分配内存的话,是不行的。


具体做法如下


[cpp] view plaincopy
  1. int *tmp;  
[cpp] view plaincopy
  1. cudaMalloc((void **)&tmp, sizeof(int) * num);  
  2.       
  3.   
  4. cudaMemcpyToSymbol(a, &tmp, sizeof(int *),size_t(0), cudaMemcpyHostToDevice);  

使用cudaMemcpyToSymbol来把一个动态分配的设备指针写入一个静态的符号。所以是sizeof(int *),只是把指针写给a。



2. 定义和使用常量变量

1、赋值方法

__constant__ char g_chFuncIndex ;

cutilSafeCall( cudaMemcpyToSymbol( "g_chFuncIndex", i_chFuncIndex, sizeof( char ) ) ) ;

 

2、访问权限

   只可以在cuda的__global__ 或者__device__函数中访问,不可以在外部C函数(extern "C" )中使用


3.定义和使用共享变量

在__global__核函数内部定义__shared__float Mds[TILE_WIDTH][TILE_WIDTH];

直接使用即可。


4.定义和使用local类型变量

默认在__global__内部直接定义的int a,即为local类型的变量


5,

使用cudaMemcpyToSymbol来把一个动态分配的设备指针写入一个静态的符号。所以是sizeof(int *),只是把指针写给a。


拷贝数组:
__device__ double d_a[2];

int main()
{
    double h_a[2];

    h_a[0]=0.1;
    h_a[1]=0.2;
    
    cudaMemcpyToSymbol(d_a, h_a, 2*sizeof(double));

    return 0;
}

拷贝变量:
__device__ double d_a;
int main()
{
    double h_a;

    h_a=0.1;;
    
    cudaMemcpyToSymbol(d_a, &h_a, sizeof(double));

    return 0;
}

原创粉丝点击