
aclskScopeBegin【免费下载链接】geGEGraph Engine是面向昇腾的图编译器和执行器提供了计算图优化、多流并行、内存复用和模型下沉等技术手段加速模型执行效率减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge产品支持情况Ascend 950PR/Ascend 950DT不支持Atlas A3 训练系列产品/Atlas A3 推理系列产品支持Atlas A2 训练系列产品/Atlas A2 推理系列产品不支持Atlas 200I/500 A2 推理产品不支持Atlas 推理系列产品不支持Atlas 训练系列产品不支持IPV350不支持头文件#include super_kernel/super_kernel.h功能说明标记Super Kernel作用域的结束位置。调用该接口后会在指定Stream上下发scope_begin kernel及placeholder kernel用于标识一组需要融合执行的算子操作的起始边界。函数原型aclError aclskScopeBegin(const char* scopeName, aclrtStream stream)参数说明参数名输入/输出描述scopeName输入Super Kernel作用域的名称用于唯一标识一个融合作用域。若传入为nullptr则标识不融合。stream输入指定的acl运行时流作用域标记kernel将在此流上执行。返回值说明返回0表示成功返回其他值表示失败。返回ACL_ERROR_INVALID_PARAM表示参数无效scopeName为空字符串数组或长度超过255个字符。约束说明与aclskScopeEnd成对使用传入的scopeName与aclskScopeEnd一致。scope name名称不超过256B字节注scopeName入参类型是charscopeName实际有效名称长度不超过255字节。全局支持的scopename不同数量不超过256个。【免费下载链接】geGEGraph Engine是面向昇腾的图编译器和执行器提供了计算图优化、多流并行、内存复用和模型下沉等技术手段加速模型执行效率减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考