cuda中各种类型的变量的总结(有转载的,有添加的)

1 定义和使用全局变量
[cpp]  view plain copy
  1. 假设定义了全局变量 __device__ int *a;  

我需要一个数组,动态分配,那么直接调用cudaMalloc来为a分配内存的话,是不行的。


具体做法如下


[cpp]  view plain copy
  1. int *tmp;  
[cpp]  view plain copy
  1. cudaMalloc((void **)&tmp, sizeof(int) * num);  
  2.       
  3.   
  4. cudaMemcpyToSymbol(a, &tmp, sizeof(int *),size_t(0), cudaMemcpyHostToDevice);  

使用cudaMemcpyToSymbol来把一个动态分配的设备指针写入一个静态的符号。所以是sizeof(int *),只是把指针写给a。



2. 定义和使用常量变量

1、赋值方法

__constant__ char g_chFuncIndex ;

cutilSafeCall( cudaMemcpyToSymbol( "g_chFuncIndex", i_chFuncIndex, sizeof( char ) ) ) ;

 

2、访问权限

   只可以在cuda的__global__ 或者__device__函数中访问,不可以在外部C函数(extern "C" )中使用


3.定义和使用共享变量

在__global__核函数内部定义__shared__float Mds[TILE_WIDTH][TILE_WIDTH];

直接使用即可。


4.定义和使用local类型变量

默认在__global__内部直接定义的int a,即为local类型的变量


5,

使用cudaMemcpyToSymbol来把一个动态分配的设备指针写入一个静态的符号。所以是sizeof(int *),只是把指针写给a。


拷贝数组:
__device__ double d_a[2];

int main()
{
    double h_a[2];

    h_a[0]=0.1;
    h_a[1]=0.2;
    
    cudaMemcpyToSymbol(d_a, h_a, 2*sizeof(double));

    return 0;
}

拷贝变量:
__device__ double d_a;
int main()
{
    double h_a;

    h_a=0.1;;
    
    cudaMemcpyToSymbol(d_a, &h_a, sizeof(double));

    return 0;
}

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

野狼位位

给点辛苦费0.1元

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值