Skip to content

DataCachePreload

产品支持情况

  • Ascend 950PR/Ascend 950DT:支持
  • Atlas A3 训练系列产品/Atlas A3 推理系列产品:支持
  • Atlas A2 训练系列产品/Atlas A2 推理系列产品:支持
  • Atlas 200I/500 A2 推理产品:支持
  • Atlas 推理系列产品AI Core:支持
  • Atlas 推理系列产品Vector Core:不支持
  • Atlas 训练系列产品:不支持

功能说明

头文件路径为:"basic_api/kernel_operator_cache_intf.h"

从源地址所在的特定GM地址预加载数据到DCache中,每次调用只能预加载一个Cache Line大小的数据。

函数原型

C++
template <typename T>
__aicore__ inline void DataCachePreload(const GlobalTensor<uint64_t>& src, const T cacheOffset)

参数说明

表1 参数说明

参数名输入/输出描述
src输入源操作数,类型为GlobalTensor。支持的数据类型为:uint64_t。
cacheOffset输入在源操作数上偏移cacheOffset大小开始加载数据,单位为byte,支持的数据类型为:int16_t/int64_t。

返回值说明

约束说明

频繁调用此接口可能导致保留站(Reservation Station,用于暂存待执行指令的硬件队列)发生拥塞。在此情况下,该指令将被视为NOP指令,进而阻塞Scalar流水线。因此,建议连续调用此接口的次数不要超过4次。

调用示例

C++
AscendC::GlobalTensor<uint64_t> srcGlobal;
int64_t cacheOffset = 0;
AscendC::DataCachePreload(srcGlobal, cacheOffset);

免责声明:本站内容由 asc-devkit 仓 master 分支自动编译生成,属于持续开发版本,可能存在缺陷,仅供预览与参考。如需稳定及商用资料,请查阅官方 昇腾社区