Skip to content

MoveMask

产品支持情况

  • Ascend 950PR/Ascend 950DT:支持
  • Atlas A3 训练系列产品/Atlas A3 推理系列产品:不支持
  • Atlas A2 训练系列产品/Atlas A2 推理系列产品:不支持
  • Atlas 200I/500 A2 推理产品:不支持
  • Atlas 推理系列产品AI Core:不支持
  • Atlas 推理系列产品Vector Core:不支持
  • Atlas 训练系列产品:不支持

功能说明

头文件路径为:"basic_api/reg_compute/kernel_reg_compute_maskreg_intf.h"

SetVectorMask设置的掩码寄存器{MASK1, MASK0}中读取Mask值,并按模板参数T对应的数据格式转换后写入返回值MaskReg。具体实现方式如下:

b16类型读取完整128bit的{MASK1, MASK0},将每个bit复制为2bit;b32类型读取64bit的MASK0,并将每个bit复制为4bit。

A2/A3与950 Mask机制对比

Mask与MaskReg的机制对比,具体请参考A2/A3与950 Mask机制对比

函数原型

C++
template <typename T> 
__simd_callee__ inline MaskReg MoveMask()

参数说明

表1 模板参数说明

参数名描述
T数据类型,决定mask值写入格式:
• 对于b16类型,会读取完整的128bit {MASK1, MASK0}数据,并将每bit复制为2bit,写入函数返回值MaskReg。
• 对于b32类型,会读取64bit MASK0数据,并将每bit复制为4bit,写入函数返回值MaskReg。

数据类型

支持的数据类型:b16、b32。

返回值说明

特殊寄存器中读取的MaskReg。

约束说明

调用示例

C++
template <typename T>
__simd_vf__ inline void MoveMaskVF(__ubuf__ T* dstAddr, __ubuf__ T* srcAddr, uint32_t count, uint32_t oneRepeatSize, uint16_t repeatTimes)
{
    AscendC::Reg::RegTensor<T> srcReg;
    AscendC::Reg::MaskReg addMask = AscendC::Reg::MoveMask<T>();
    AscendC::Reg::MaskReg mask;
    for (uint16_t i = 0; i < repeatTimes; ++i) {
        mask = AscendC::Reg::UpdateMask<T>(count);
        AscendC::Reg::LoadAlign(srcReg, srcAddr + i * oneRepeatSize);
        AscendC::Reg::Adds(srcReg, srcReg, 0, addMask);
        AscendC::Reg::StoreAlign(dstAddr + i * oneRepeatSize, srcReg, mask);
    }
}

免责声明:本站内容由 asc-devkit 仓 master 分支自动编译生成,属于持续开发版本,可能存在缺陷,仅供预览与参考。如需稳定及商用资料,请查阅官方 昇腾社区