CUDA入门笔记(三)GPU编程基础——一个典型GPU程序

本文介绍了CUDA GPU编程的基础,包括典型GPU程序的四个步骤:GPU内存分配、数据传输、内核函数调用和结果回传。强调了GPU的并行计算优势,适合处理大量运算任务。并以一个数组元素平方计算为例,详细解析了如何编写和执行GPU程序,包括CPU与GPU间的交互、线程块和线程配置,以及线程索引的概念。

摘要生成于 C知道 ,由 DeepSeek-R1 满血版支持, 前往体验 >

参考:

优达学城:https://classroom.udacity.com/courses/cs344/lessons/55120467/concepts/670611900923

 

一、典型GPU程序构成

一个典型GPU程序有如下几个部分:

①CPU在GPU上分配内存

②CPU将CPU中的数据copy到GPU中

③调用内核函数来处理数据

④CPU将GPU中的数据copy到CPU中

 

*可以看出,四个步骤中有两个是数据的copy,因此如果你的程序需要不断地进行copy,那么运行效率会比较低,不适合利用GPU运算。

一般情况下,最好的方式是,让GPU进行大量运算,同时保证计算量与通信的比值很高。

 

二、运行程序时GPU是如何运作的?

前面提到,我们将运算看作是一个由一系列或多个内核组成的结构。GPU有很多并行的计算单元,那么当我们写kernels的时候,应该充分利用这些硬件并行。

 

★Big Idea(one of the very core concept of CUDA):

当你在写程序的时候,你把它写的像是一个串行的程序,就好像是在一个单独的线程里运行一样。当你从CPU调用核的时候,就给核规定好要启动几个线程,每一个线程都会运行这个程序(的一部分?,存疑)。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值