asc_bfloat162float(废弃)
产品支持情况
- Ascend 950PR/Ascend 950DT:支持
- Atlas A3 训练系列产品/Atlas A3 推理系列产品:不支持
- Atlas A2 训练系列产品/Atlas A2 推理系列产品:不支持
- Atlas 200I/500 A2 推理产品:不支持
- Atlas 推理系列产品AI Core:不支持
- Atlas 推理系列产品Vector Core:不支持
- Atlas 训练系列产品:不支持
功能说明
头文件路径为:"c_api/reg_compute/reg_convert.h"。
该接口通过接口后缀来控制源操作数读取位置(仅包括源操作数、目的操作数、掩码寄存器三个参数)的原型已废弃,请使用asc_bfloat162float的显式位置参数重载替代。
根据mask将src中的每个参与计算的bfloat16_t类型元素转换为float类型,结果写入dst。由于源操作数与目的操作数类型位宽比为1:2,读取数据时需要将一个VL大小的数据分为两部分,根据接口后缀选择读取src索引为偶数的位置或奇数的位置。伪代码如下:
Python
def asc_bfloat162float(dst, src, mask):
for i in range(64):
if mask[2 * i]:
dst[i] = float(src[2 * i]) # bfloat16 -> float,读取偶数索引
else:
dst[i] = 0
def asc_bfloat162float_v2(dst, src, mask):
for i in range(64):
if mask[2 * i + 1]:
dst[i] = float(src[2 * i + 1]) # bfloat16 -> float,读取奇数索引
else:
dst[i] = 0
迁移说明
表1 新旧位置参数对应关系
| 旧原型位置后缀 | 新原型位置参数 |
|---|---|
| 无位置后缀 | ASC_POSITION_EVEN |
_v2 | ASC_POSITION_ODD |
迁移时移除函数名中的位置后缀,并将对应位置常量作为第四个参数传入。新原型请参见asc_bfloat162float。
函数原型
模板原型(占位符形式)
C
__simd_callee__ inline void asc_bfloat162float<position_mode>(vector_float& dst,
vector_bfloat16_t src,
vector_bool mask)
占位符说明
<position_mode>表示src读取的位置,为空时,结果读取src的偶数索引位置;取值为_v2时,结果读取src的奇数索引位置。
函数原型典型示例
C
// 读取src索引为偶数的位置
__simd_callee__ inline void asc_bfloat162float(vector_float& dst,
vector_bfloat16_t src,
vector_bool mask)
参数说明
表2 参数说明
| 参数名 | 输入/输出 | 描述 |
|---|---|---|
| dst | 输出 | 目的操作数(矢量数据寄存器)。 |
| src | 输入 | 源操作数(矢量数据寄存器)。 |
| mask | 输入 | 掩码寄存器,用于控制各元素是否参与计算。mask中与元素对应的比特位为1时,该元素参与计算;为0时,该元素不参与计算。 |
矢量数据寄存器和掩码寄存器的详细说明请参见reg数据类型定义。
返回值说明
无
约束说明
- 通过引用参数输出结果的函数原型在非AIV上调用时直接返回。
- 本接口在Vector Function(
__simd_vf__标记的函数)内调用。 mask需通过掩码设置接口预先赋值后再传入,未赋值的掩码寄存器内容不确定,会导致有效元素位置错误。mask掩码位为0时,dst对应元素置0。
调用示例
C++
vector_float dst;
vector_bfloat16_t src;
vector_bool mask;
mask = asc_create_mask_b16(PAT_ALL);
asc_bfloat162float(dst, src, mask); // 读取src索引为偶数的位置
asc_bfloat162float_v2(dst, src, mask); // 读取src索引为奇数的位置