
aclmdlExeOMDesc【免费下载链接】geGEGraph Engine是面向昇腾的图编译器和执行器提供了计算图优化、多流并行、内存复用和模型下沉等技术手段加速模型执行效率减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/getypedef struct aclmdlExeOMDesc { size_t workSize; size_t weightSize; size_t modelDescSize; size_t kernelSize; size_t kernelArgsSize; size_t staticTaskSize; size_t dynamicTaskSize; size_t fifoTaskSize; size_t reserved[8]; } aclmdlExeOMDesc;成员名称描述workSize模型执行时所需的工作内存的大小单位Byte。weightSize模型执行时所需的权值内存的大小单位Byte。modelDescSize存放模型描述信息所需的内存大小单位Byte。kernelSize存放TBE算子kernel算子的*.o与*.json所需的内存大小单位Byte。kernelArgsSize存放TBE算子kernel参数所需的内存大小单位Byte。staticTaskSize存放静态shape任务描述信息所需的内存大小单位Byte。dynamicTaskSize存放动态shape任务描述信息所需的内存大小单位Byte。fifoTaskSize存放模型级别的全局内存大小单位Byte。若某个模型在推理时其每一层的输入来自上一层的输出以及前面几轮推理结果拼接而成时则需使用模型级别的全局内存将该模型所需的输入数据保存下来供后续推理使用。reserved预留值。【免费下载链接】geGEGraph Engine是面向昇腾的图编译器和执行器提供了计算图优化、多流并行、内存复用和模型下沉等技术手段加速模型执行效率减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考