Skip to content

GetTensorC

产品支持情况

  • Ascend 950PR/Ascend 950DT:不支持
  • Atlas A3 训练系列产品/Atlas A3 推理系列产品:支持
  • Atlas A2 训练系列产品/Atlas A2 推理系列产品:支持
  • Atlas 200I/500 A2 推理产品:不支持
  • Atlas 推理系列产品AI Core:不支持
  • Atlas 推理系列产品Vector Core:不支持
  • Atlas 训练系列产品:不支持

功能说明

在完成Iterate操作后调用本接口,获取结果矩阵块,完成数据从L0C到GM的搬运。此接口与Iterate接口配合使用,用于在Iterate执行迭代计算后,获取结果矩阵。

函数原型

Text
template <bool sync = true>
__aicore__ inline void GetTensorC(const AscendC::GlobalTensor<DstT>& output, uint8_t enAtomic = 0, bool enSequentialWrite = false)

参数说明

表1 模板参数说明

参数名描述
sync预留参数,用户无需感知。

表2 接口参数说明

参数名输入/输出描述
output输入将计算结果搬至Global Memory的GM地址。
enAtomic输入预留参数,用户无需感知。
enSequentialWrite输入预留参数,用户无需感知。

返回值说明

约束说明

GetTensorC接口必须在Iterate后进行调用,完成卷积反向实现,调用顺序如下。

Text
while (Iterate()) {
    GetTensorC();
}

调用示例

Text
while (gradInput_.Iterate()) {
    gradInput_.GetTensorC(gradInputGm_[offsetC_]);
}

免责声明:本站内容由 asc-devkit 仓 master 分支自动编译生成,属于持续开发版本,可能存在缺陷,仅供预览与参考。如需稳定及商用资料,请查阅官方 昇腾社区