CANN/asc-devkit原子异或操作API

asc_atomic_xor

【免费下载链接】asc-devkit 本项目是CANN 推出的昇腾AI处理器专用的算子程序开发语言,原生支持C和C++标准规范,主要由类库和语言扩展层构成,提供多层级API,满足多维场景算子开发诉求。 【免费下载链接】asc-devkit 项目地址: https://gitcode.com/cann/asc-devkit

产品支持情况

  • Ascend 950PR/Ascend 950DT:支持
  • Atlas A3 训练系列产品/Atlas A3 推理系列产品:不支持
  • Atlas A2 训练系列产品/Atlas A2 推理系列产品:不支持
  • Atlas 200I/500 A2 推理产品:不支持
  • Atlas 推理系列产品AI Core:不支持
  • Atlas 推理系列产品Vector Core:不支持
  • Atlas 训练系列产品:不支持

功能说明

头文件路径:"c_api/scalar_compute/scalar_compute.h"

对Global Memory中的数据与指定数据执行原子异或操作,即将val按位异或到address指向的数据元素上。

函数原型

__aicore__ inline int32_t asc_atomic_xor(__gm__ int32_t *address, int32_t val)

__aicore__ inline uint32_t asc_atomic_xor(__gm__ uint32_t *address, uint32_t val)

__aicore__ inline int64_t asc_atomic_xor(__gm__ int64_t *address, int64_t val)

__aicore__ inline uint64_t asc_atomic_xor(__gm__ uint64_t *address, uint64_t val)

参数说明

参数名输入/输出描述
address输出Global Memory的地址。
val输入源操作数。

返回值说明

address地址中计算前的原始数据。

流水类型

PIPE_S

约束说明

  • 在开启编译器自动同步功能的前提下,编译器能够自动在PIPE_MTE2/PIPE_MTE3与PIPE_S之间插入同步。但是,asc_atomic_xor为标量计算,在读写GM时如果与搬运单元(MTE2/MTE3)存在数据依赖,编译器却无法自动插入同步,开发者需要根据实际情况手动插入同步。
  • Scalar原子操作会绕过DCache,需要调用asc_dcci接口确保GM与DCache的一致性。

调用示例

uint32_t dst = 0x0;     // 初始值
asc_dcci_entire_all();            // 手动同步
uint32_t old = asc_atomic_xor(&dst, 0x1);  // dst = 0x1, old = 0x0

【免费下载链接】asc-devkit 本项目是CANN 推出的昇腾AI处理器专用的算子程序开发语言,原生支持C和C++标准规范,主要由类库和语言扩展层构成,提供多层级API,满足多维场景算子开发诉求。 【免费下载链接】asc-devkit 项目地址: https://gitcode.com/cann/asc-devkit

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值