
精度比对【免费下载链接】geGEGraph Engine是面向昇腾的图编译器和执行器提供了计算图优化、多流并行、内存复用和模型下沉等技术手段加速模型执行效率减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/geBUFFER_OPTIMIZE数据缓存优化开关。此参数实际对应的options参数为ge.bufferOptimize。参数取值l1_optimize表示开启l1优化。当前版本该参数无效等同于off_optimize。l2_optimize默认值表示开启l2优化。off_optimize表示关闭数据缓存优化。其中l1表示L1 Buffer通用内部存储是AI Core内比较大的一块数据中转区可暂存AI Core中需要反复使用的一些数据从而减少从总线读写的次数l2表示L2 Buffer表示外部存储AI Core需要把外部存储中的数据加载到内部存储中才能完成相应的计算。使用建议建议打开数据缓存优化功能开启数据缓存优化可提高计算效率、提升性能但由于部分算子在实现上可能存在未考虑的场景导致影响精度因此在出现精度问题时可以尝试关闭数据缓存优化。如果关闭数据缓存优化功能后精度达标则需要识别出问题算子反馈给技术支持进一步分析、解决算子问题解决算子问题后建议仍旧保持开启数据缓存优化功能。配置示例{ge::ir_option::BUFFER_OPTIMIZE, l2_optimize}产品支持情况全量芯片支持。FUSION_SWITCH_FILE此参数实际对应的options参数为ge.fusionSwitchFile。融合开关配置文件路径以及文件名路径和文件名支持大小写字母a-zA-Z、数字0-9、下划线_、中划线-、句点.、中文字符。系统内置了一些图融合和UB融合规则均为默认开启可以根据需要关闭指定的融合规则当前可以关闭的融合规则请参见《图融合和UB融合规则参考》但是由于系统机制其他融合规则无法关闭。Ascend 950PR/Ascend 950DT不支持UB融合。配置示例配置文件样例_fusion_switch.cfg_on表示开启off表示关闭。配置样例{ Switch:{ GraphFusion:{ RequantFusionPass:on, ConvToFullyConnectionFusionPass:off, SoftmaxFusionPass:on, NotRequantFusionPass:on, SplitConvConcatFusionPass:on, ConvConcatFusionPass:on, MatMulBiasAddFusionPass:on, PoolingFusionPass:on, ZConcatv2dFusionPass:on, ZConcatExt2FusionPass:on, TfMergeSubFusionPass:on } } }不支持UB融合时上述配置文件可以删除UBFusion。同时支持用户一键关闭融合规则配置文件样例{ Switch:{ GraphFusion:{ ALL:off }, UBFusion:{ ALL:off } } }不支持UB融合时上述配置文件可以删除UBFusion。需要注意的是关闭某些融合规则可能会导致功能问题因此此处的一键式关闭仅关闭系统部分融合规则而不是全部融合规则。一键式关闭融合规则时可以同时开启部分融合规则配置文件样例{ Switch:{ GraphFusion:{ ALL:off, SoftmaxFusionPass:on }, UBFusion:{ ALL:off, TbePool2dQuantFusionPass:on } } }不支持UB融合时上述配置文件可以删除UBFusion。产品支持情况全量芯片支持。【免费下载链接】geGEGraph Engine是面向昇腾的图编译器和执行器提供了计算图优化、多流并行、内存复用和模型下沉等技术手段加速模型执行效率减少模型内存占用。 GE 提供对 PyTorch、TensorFlow 前端的友好接入能力并同时支持 onnx、pb 等主流模型格式的解析与编译。项目地址: https://gitcode.com/cann/ge创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考