cuda原子操作

本文详细介绍了CUDA编程中原子函数的使用方法,包括atomicAdd、atomicSub、atomicExch等常见原子操作函数的用法及注意事项。特别强调了不同计算能力设备对原子操作的支持情况,以及如何在编译时指定计算能力以避免运行时错误。


int atomicAdd(int* address, int val);

unsigned int atomicAdd(unsigned int* address,

                           unsigned int val);

unsigned long long int atomicAdd(unsigned long long int* address,

                                        unsigned long long int val);

读取位于全局或共享存储器中地址address 处的32 位或64 位字old,计算(old + val),并将结果存储在存储器的同一地址中。这三项操作在一次原子事务中执行。该函数将返回old

只有全局存储器支持64 位字。

C.1.2  atomicSub()

int atomicSub(int* address, int val);

unsigned int atomicSub(unsigned int* address,

                           unsigned int val);

读取位于全局或共享存储器中地址address 处的32 位字old,计算(old - val),并将结果存储在存储器的同一地址中。这三项操作在一次原子事务中执行。该函数将返回old

C.1.3  atomicExch()

int atomicExch(int* address, int val);

unsigned int atomicExch(unsigned int* address,

                            unsigned int val);

unsigned long long int atomicExch(unsigned long long int* address,

                                        unsigned long long int val);

float atomicExch(float* address, float val);

读取位于全局或共享存储器中地址address 处的32 位或64 位字old,并将val 存储在存储器的同一地址中。这两项操作在一次原子事务中执行。该函数将返回old

只有全局存储器支持64 位字。

C.1.4  atomicMin()

int atomicMin(int* address, int val);

unsigned int atomicMin(unsigned int* address,

                           unsigned int val);

读取位于全局或共享存储器中地址address 处的32 位字old,计算old val 的最小值,并将结果存储在存储器的同一地址中。这三项操作在一次原子事务中执行。该函数将返回old

C.1.5  atomicMax()

int atomicMax(int* address, int val);

unsigned int atomicMax(unsigned int* address,

                           unsigned int val);

读取位于全局或共享存储器中地址address 处的32 位字old,计算old val 的最大值,并将结果存储在存储器的同一地址中。这三项操作在一次原子事务中执行。该函数将返回old

C.1.6  atomicInc()

unsigned int atomicInc(unsigned int* address,

                       unsigned int val);

读取位于全局或共享存储器中地址address 处的32 位字old,计算 ((old >= val) ? 0 : (old+1)),并将结果存储在存储器的同一地址中。这三项操作在一次原子事务中执行。该函数将返回old

C.1.7  atomicDec()

unsigned int atomicDec(unsigned int* address,

                           unsigned int val);

读取位于全局或共享存储器中地址address 处的32 位字old,计算 (((old == 0) | (old > val)) ? val : (old-1)),并将结果存储在存储器的同一地址中。这三项操作在一次原子事务中执行。该函数将返回old

C.1.8  atomicCAS()

int atomicCAS(int* address, int compare, int val);

unsigned int atomicCAS(unsigned int* address,

                           unsigned int compare,

                           unsigned int val);

unsigned long long int atomicCAS(unsigned long long int* address,

                                       unsigned long long int compare,

                                       unsigned long long int val);

读取位于全局或共享存储器中地址address 处的32 位或64 位字old,计算 (old == compare ? val : old),并将结果存储在存储器的同一地址中。这三项操作在一次原子事务中执行。该函数将返回old(比较并交换)。

只有全局存储器支持64 位字。

C.2  位逻辑函数C.2.1  atomicAnd()

int atomicAnd(int* address, int val);

unsigned int atomicAnd(unsigned int* address,

                           unsigned int val);

读取位于全局或共享存储器中地址address 处的32 位字old,计算 (old & val),并将结果存储在存储器的同一地址中。这三项操作在一次原子事务中执行。该函数将返回old

C.2.2  atomicOr()

int atomicOr(int* address, int val);

unsigned int atomicOr(unsigned int* address,

                          unsigned int val);

读取位于全局或共享存储器中地址address 处的32 位字old,计算 (old | val),并将结果存储在存储器的同一地址中。这三项操作在一次原子事务中执行。该函数将返回old

C.2.3  atomicXor()

int atomicXor(int* address, int val);

unsigned int atomicXor(unsigned int* address,

                           unsigned int val);

读取位于全局或共享存储器中地址address 处的32 位字old,计算 (old ^ val),并将结果存储在存储器的同一地址中。这三项操作在一次原子事务中执行。该函数将返回old

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值