cuda中各种类型的变量的总结(有转载的,有添加的)

1 定义和使用全局变量
  1. 假设定义了全局变量 __device__ int *a;  

我需要一个数组,动态分配,那么直接调用cudaMalloc来为a分配内存的话,是不行的。


具体做法如下


  1. int *tmp;  
  1. cudaMalloc((void **)&tmp, sizeof(int) * num);  
  2.       
  3.   
  4. cudaMemcpyToSymbol(a, &tmp, sizeof(int *),size_t(0), cudaMemcpyHostToDevice);  

使用cudaMemcpyToSymbol来把一个动态分配的设备指针写入一个静态的符号。所以是sizeof(int *),只是把指针写给a。



2. 定义和使用常量变量

1、赋值方法

__constant__ char g_chFuncIndex ;

cutilSafeCall( cudaMemcpyToSymbol( "g_chFuncIndex", i_chFuncIndex, sizeof( char ) ) ) ;

 

2、访问权限

   只可以在cuda的__global__ 或者__device__函数中访问,不可以在外部C函数(extern "C" )中使用


3.定义和使用共享变量

在__global__核函数内部定义__shared__float Mds[TILE_WIDTH][TILE_WIDTH];

直接使用即可。


4.定义和使用local类型变量

默认在__global__内部直接定义的int a,即为local类型的变量


5,

使用cudaMemcpyToSymbol来把一个动态分配的设备指针写入一个静态的符号。所以是sizeof(int *),只是把指针写给a。


拷贝数组:
__device__ double d_a[2];

int main()
{
    double h_a[2];

    h_a[0]=0.1;
    h_a[1]=0.2;
    
    cudaMemcpyToSymbol(d_a, h_a, 2*sizeof(double));

    return 0;
}

拷贝变量:
__device__ double d_a;
int main()
{
    double h_a;

    h_a=0.1;;
    
    cudaMemcpyToSymbol(d_a, &h_a, sizeof(double));

    return 0;
}

发布了119 篇原创文章 · 获赞 29 · 访问量 20万+
展开阅读全文

没有更多推荐了,返回首页

©️2019 CSDN 皮肤主题: 编程工作室 设计师: CSDN官方博客

分享到微信朋友圈

×

扫一扫,手机浏览