Skip to content

总体说明

矩阵计算的搬出是Ascend C编程框架中用于数据搬运的一类核心接口,主要实现L0C Buffer与Global Memory、L1 Buffer、Unified Buffer(UB)之间的数据高效传输。该接口系列提供了多种数据搬运模式,能够满足矩阵计算中的数据搬运需求,通常在Mmad接口后配合使用。

矩阵计算的搬出接口支持多种随路搬运场景,包括随路量化、随路ReLU、随路格式转换(NZ2ND、NZ2DN)、随路通道拆分(Channel Split)、随路通道合并(Channel Merge)、UB双目标模式。通过灵活配置不同的参数结构体,开发者可以精确控制数据的搬运路径、起始位置、搬运长度、随路搬运能力等关键信息,充分利用硬件的数据搬运能力,最大化算子的整体执行性能。

矩阵计算的搬出整体流程如下图所示:

图1 矩阵计算的搬出整体流程图(NPU架构版本2201

图2 矩阵计算的搬出整体流程图(NPU架构版本3510

其中,Fixpipe Buffer不同的量化模式对应的内存排布如下:

图3 Fixpipe Buffer内存排布图

免责声明:本站内容由 asc-devkit 仓 master 分支自动编译生成,属于持续开发版本,可能存在缺陷,仅供预览与参考。如需稳定及商用资料,请查阅官方 昇腾社区