1.检查环境
which nvcc输出
2.编写代码
#include<stdio.h>
__global__ void helloDevice(void){
printf("hello cuda_GPU\n"); //global关键字 host调用 device执行
}
int main(void){
printf("hello cuda_host!\n");
helloDevice <<<2,2>>>(); //用两个块,两个线程。
cudaDeviceReset();
}3.编译
nvcc hello.cu -o hello
4.输出
这里是两个块,两个线程,所以打印4次。
本文介绍了一个简单的CUDA编程示例,包括环境检查、代码编写、编译和运行等步骤。通过使用两个块和两个线程,程序在GPU上并行执行,展示了基本的CUDA编程流程。

2万+

被折叠的 条评论
为什么被折叠?



