问题描述:
以NPU卡功耗为例,在电源&功率->功率页面显示的值为从NPU中读出的原始值:
而在离散传感器页面,显示的则是经过传感器线性计算方程计算出的值:
![]()
两者差别可能会很大,这种情况是符合预期的么?客户对此存在疑问我们应该如何解释?
问题描述:
以NPU卡功耗为例,在电源&功率->功率页面显示的值为从NPU中读出的原始值:
而在离散传感器页面,显示的则是经过传感器线性计算方程计算出的值:
![]()
两者差别可能会很大,这种情况是符合预期的么?客户对此存在疑问我们应该如何解释?
差得多就是配的有问题啊,传感器对象里的参数是不是配错了
从结果来看传感器那边是对的(gpu的功耗不超过150W),传感器的表达式将原始读值除了10。而功耗页面则是直接展示了读值
我们是以类似方式进行修改的 但是这种修改有个问题:当前这款NPU功耗读出来要除10,其他NPU功耗可能不需要除10。 在这里修改的话,还要加上型号判断,局限性太大
优化redfish查询ECC信息的异常默认值;修复NPU的snmp接口电压、功耗显示double类型数据报错;优化SDI卡功耗显示-rackmount-GitCode
该问题可以延伸为硬件原始值的缩放计算的不统一问题,已在interface sig讨论后提了issue:【问题单】从硬件读出来的原始值的缩放计算不应该放在北向接口中,以xPU功耗为例-rackmount-GitCode
后续会有专门的负责人统一整改该问题