Skip to content

GetBlockIdx

产品支持情况

  • Ascend 950PR/Ascend 950DT:支持
  • Atlas A3 训练系列产品/Atlas A3 推理系列产品:支持
  • Atlas A2 训练系列产品/Atlas A2 推理系列产品:支持
  • Atlas 200I/500 A2 推理产品:支持
  • Atlas 推理系列产品AI Core:支持
  • Atlas 推理系列产品Vector Core:不支持
  • Atlas 训练系列产品:支持
  • Kirin X90:支持
  • Kirin 9030:支持

功能说明

头文件路径为:"basic_api/kernel_operator_sys_var_intf.h"

获取当前逻辑AI Core的索引,用于代码内部的多核逻辑控制及多核偏移量计算等。

函数原型

C++
__aicore__ inline int64_t GetBlockIdx()

参数说明

返回值说明

返回当前逻辑AI Core的索引。

  • 仅启动AIC或AIV的场景,索引的范围为[0, numBlocks)。numBlocks由用户使用<<<>>>调用时配置,可以通过GetBlockNum获取。
  • 同时启动AIC与AIV的场景,在AIC、AIV上索引的取值范围不同,取值范围可以通过GetTaskRatio() * numBlocks计算得到,在当前支持的配置下:
    • 当AIC与AIV比例为1:2时,AIC上取值范围为[0, numBlocks),AIV上取值范围为[0, 2 * numBlocks);
    • 当AIC与AIV比例为1:1时,AIC上取值范围为[0, numBlocks),AIV上取值范围为[0, numBlocks)。

约束说明

调用示例

C++
// srcGm、dstGm为外部输入的gm空间
AscendC::GlobalTensor<float> srcGlobal;
AscendC::GlobalTensor<float> dstGlobal;
int64_t blockNum = AscendC::GetBlockNum(); // 获取当前任务配置的逻辑AI Core的数量
int64_t perBlockSize = srcDataSize / blockNum; // 每个核平分处理相同个数
int64_t blockIdx = AscendC::GetBlockIdx(); // 获取当前工作的核ID
srcGlobal.SetGlobalBuffer(reinterpret_cast<__gm__ float*>(srcGm + blockIdx * perBlockSize * sizeof(float)), perBlockSize);    // 分配每个核上的srcGlobal的内存地址
dstGlobal.SetGlobalBuffer(reinterpret_cast<__gm__ float*>(dstGm + blockIdx * perBlockSize * sizeof(float)), perBlockSize);    // 分配每个核上的dstGlobal的内存地址

免责声明:本站内容由 asc-devkit 仓 master 分支自动编译生成,属于持续开发版本,可能存在缺陷,仅供预览与参考。如需稳定及商用资料,请查阅官方 昇腾社区