资讯动态

CANN/GE ACL半精度矩阵乘法

发布时间:2026/9/10 2:15:16 来源:尧图企业网站定制
aclblasHgemm【免费下载链接】geGEGraph Engine是面向昇腾的图编译器和执行器提供了计算图优化、多流并行、内存复用和模型下沉等技术手段加速模型执行效率减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge产品支持情况Ascend 950PR/Ascend 950DT不支持Atlas A3 训练系列产品/Atlas A3 推理系列产品支持Atlas A2 训练系列产品/Atlas A2 推理系列产品支持Atlas 200I/500 A2 推理产品支持Atlas 推理系列产品支持Atlas 训练系列产品支持IPV350不支持功能说明执行矩阵-矩阵的乘法C αAB βC输入数据和输出数据的数据类型为aclFloat16。异步接口。函数原型aclError aclblasHgemm(aclTransType transA, aclTransType transB, aclTransType transC, int m, int n, int k, const aclFloat16 *alpha, const aclFloat16 *matrixA, int lda, const aclFloat16 *matrixB, int ldb, const aclFloat16 *beta, aclFloat16 *matrixC, int ldc, aclComputeType type, aclrtStream stream)参数说明参数名输入/输出说明transA输入A矩阵是否转置的标记。类型定义请参见aclTransType。transB输入B矩阵是否转置的标记。类型定义请参见aclTransType。transC输入C矩阵的标记。类型定义请参见aclTransType。当前仅支持ACL_TRANS_N。m输入矩阵A的行数与矩阵C的行数。n输入矩阵B的列数与矩阵C的列数。k输入矩阵A的列数与矩阵B的行数。alpha输入用于执行乘操作的标量α的指针。类型定义请参见aclFloat16。matrixA输入矩阵A的指针。类型定义请参见aclFloat16。lda输入A矩阵的主维此时选择转置按行优先则lda为A的列数。预留参数当前只能设置为-1。matrixB输入矩阵B的指针。类型定义请参见aclFloat16。ldb输入B矩阵的主维此时选择转置按行优先则ldb为B的列数。预留参数当前只能设置为-1。beta输入用于执行乘操作的标量β的指针。类型定义请参见aclFloat16。matrixC输入输出矩阵C的指针。类型定义请参见aclFloat16。ldc输入C矩阵的主维预留参数当前只能设置为-1。type输入计算精度默认高精度。类型定义请参见aclComputeType。stream输入执行算子所在的Stream。类型定义请参见aclrtStream。返回值说明返回0表示成功返回其他值表示失败请参见aclError。【免费下载链接】geGEGraph Engine是面向昇腾的图编译器和执行器提供了计算图优化、多流并行、内存复用和模型下沉等技术手段加速模型执行效率减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价