
海思 HI3516 HI3519海思 HI3516DV500查看设备 Proc 信息查看NPU的工作状态海思 HI3516DV500查看设备 Proc 信息状态信息都位于此目录下/proc/umap查看NPU的工作状态执行命令cat /proc/umap/svp_npu参数介绍svp_npu_module_param SVP 图像分析引擎模块参数nppu_save_power低功耗标志通过模块参数 svp_npu_save_power 配置。0关闭低功耗1开启低功耗。max_task_node_num用于约束单个 Stream 的最大任务节点个数取值范围为 [2, 512]默认值为 32。用户可通过模块参数 svp_npu_max_task_node_num 进行配置实际可下发的最大任务数为 (svp_npu_max_task_node_num - 1)。配置方式为在加载 svp_npu 的 ko 时使用 “svp_npu_max_task_node_num512” 参数并将 “512” 修改为所需数值。max_stream_num可用的 Stream 个数取值范围为 [1, 128]默认值为 64用户可通过模块参数 svp_npu_max_stream_num 进行配置。注仿真环境不支持通过模块参数修改配置默认 Stream 最大值为 128。max_event_num可用的硬件 Event 个数取值范围为 [0, 128]默认值为 32用户可通过模块参数 svp_npu_max_event_num 进行配置。prof_buf_size用于 Profiling 的内存大小取值范围为 [512, 1048576]单位为 KB。启动 Profiling 功能时系统内部会申请该大小的内存用户可通过模块参数 svp_npu_prof_buf_size 进行配置。dev[0] svp_npu_resource_info 设备0 SVP图像分析引擎资源信息max_model_num最多可加载的普通模型个数。free_model_num剩余可加载的普通模型个数。max_sec_model_num最多可加载的安全模型个数。free_sec_model_num剩余可加载的安全模型个数。max_stream_num最多可申请的 Stream 个数。free_stream_num剩余可申请的 Stream 个数。max_event_num最多可申请的 Event 个数。free_event_num剩余可申请的 Event 个数。max_report_num最多可申请的 Report 个数。free_report_num剩余可申请的 Report 个数。svp_npu_process_info [pid:xxxx] SVP图像分析引擎运行进程占用资源pid进程 ID。model_num进程加载的模型个数。stream_num进程申请的 Stream 个数。report_num进程申请的 Report 个数。event_num进程申请的 Event 个数。aicpu_num进程当前运行的模式识别CPU 任务个数。prof_en进程是否使能 Profiling。0 表示未使能1 表示已使能。sync_timeout进程默认阻塞等待的超时时间。单位ms。svp_npu_process stream_info 进程中运行流的信息id流 ID。sq_id使用的硬件流 ID 号。head标记流的头指针。tail标记流的尾指针。prior当前任务的实时优先级。cb_tid注册到流的 Callback 任务处理线程的 ID。cb_block是否存在未完成的阻塞型 Callback 任务。cb_block_id即将运行的阻塞型 Callback 任务的任务 ID。last_task_time当前 Stream 上最近一次任务的执行耗时。该耗时统计的是从任务下达到任务完成的时间因此在多 Stream 执行场景下此耗时包含当前任务等待其它 Stream 上任务执行的时间。push_cnt下发的任务占用流上任务节点的个数。sqe_cnt流上实际未完成的任务个数。recv_cnt流上收到的任务总个数。status同步流的运行状态信息。0空闲状态1任务可下发或任务执行中2模式识别CPU 任务处理中3任务执行完成4任务执行失败svp_npu_process_model_info 进程中模型信息id模型的 ID 编号。prior模型配置的优先级。preempt_en模型是否使能抢占其它低优先级任务。0不抢占1抢占。up_step优先级单步提升的超时时间单位 ms取值范围为 [0, 600000)。0 表示不开启优先级单步提升功能。up_top优先级最高提升的超时时间单位 ms取值范围为 [0, 600000)。0 表示不开启优先级最高提升功能。stream_id模型最近一次执行所在流的 ID。last_task_time模型最近一次执行的耗时。该耗时统计的是从任务下达到任务完成的时间因此在多 Stream 执行场景下此耗时包含当前任务等待其它 Stream 上任务执行的时间。preempted_en模型是否支持被打断的标识在模型生成时指定。具体配置可参考《ATC 工具使用指南》。name模型名称在模型离线生成时指定。最多显示 32 个字符超出部分会被裁剪。in_num模型原始输入个数不包括扩展输入。out_num模型原始输出个数不包括扩展输出。om_size模型大小单位 Byte。work_buf_size模型执行时所需的临时内存大小单位 Byte。bandwidth模型执行时的理论数据带宽开销单位 Byte。数据为 0 表示模型中没有带宽开销信息。original_ops原始模型单帧计算次数用于衡量原始模型的复杂度和算力单位 ops。数据为 0 表示模型中没有原始算力信息。cube_ops原始模型参数对齐架构后的单帧 CUBE 计算次数用于衡量模型对齐 CUBE 单元的算力。数据为 0 表示模型中没有 Cube 算力信息。input_xx_shape原始模型输入的 Shape 信息xx 代表输入编号Shape 格式为 “NxCxHxW”。output_xx_shape原始模型输出的 Shape 信息xx 代表输出编号Shape 格式为 “NxCxHxW”。svp_npu_irq_info SVP图像分析引擎中断信息device_id设备ID。irq_cnt_last_sec最近1秒内中断执行次数。max_irq_cnt_per_sec历史上的1秒内最大的中断执行次数。total_irq_cnt产生中断的总次数。cur_irq_time最近一次执行中断的执行耗时。单位us。max_irq_time执行一次中断的最大耗时。单位us。irq_time_last_sec最近一秒执行中断的执行耗时。单位us。max_irq_time_per_sec历史上一秒内执行中断的最大耗时。单位us。total_irq_time中断处理总时间。单位us。svp_npu_runtime_info SVP图像分析引擎设备运行信息device_id设备ID。hw_status硬件所处状态。0空闲。1工作。last_sq_id最近一次下发任务到图像分析引擎的硬件流的ID号。last_task_node_id最近一次在图像分析引擎上执行的任务节点id。prof_flag是否有进程使能Profiling并申请了Profiling内存。0代表没有使能1代表使能。timeout_err_cnt设备上发生超时错误的个数。hw_err_cnt设备上发生逻辑错误的个数。aicpu_err_cnt设备上发生模式识别CPU任务执行错误的个数last_hw_task_time最近一次图像分析引擎执行任务的耗时。hw_utilization最近1s内硬件执行时间所占的比例。total_running_time设备运行总时间。单位s