私はi.MX93 EVKを使っており、Ethos-UのNPU温度と稼働率(負荷)を実行時に監視したいのですが、このデータをどうやって取得できますか?
目的は、AIモデルの推論中にハードウェアパラメータを監視することです。
i.MX8MPlusで以下のパラメータを監視できます。i.MX93でも同様のことを実現したいです。
i.MX93 NPU(ethos-u)のGPU_LOADとGPU_TEMPをどうやって監視できますか?
こんにちは、@sonal-acldigital
i.MX 8M Plusも i.MX 93も、NPU温度をリアルタイムで監視する方法を提供していません。
- imx8MP、thermal_zone0はCPUの温度を表し、thermal_zone1はSoCの温度を表します。
- imx93、thermal_zone0はCPUの温度を表します。
- NPU、 nputopのようなツールは存在しません。
パフォーマンスチューニングに関する情報については、セクション7.1.2を参照してください。「ハードウェアアクセラレータのプロファイリング」、 MLユーザーガイドに収録。
B.R
@pengyong_zhang i.MX 8M Plusとi.MX 93の熱ゾーンについてご説明いただきありがとうございます。以下の点を明確にしていただけますか?
i.MX8MPLUS
1. GPU温度: 個別のGPU温度を読み取る専用のシステムパス(/sys/class/thermal/thermal/thermal_zoneX/temp)はありますか?それともソックサーマルゾーン(thermal_zone1)だけでカバーされているのでしょうか?
2. GPU負荷: /sys/kernel/debug/gc/loadを読み込むことがGPU負荷の確認の標準的な方法ですか?それともMLユーザーガイドのセクション7.1.2に詳述されている手順も必要ですか?
i.MX93:
NPUの負荷と温度を監視するネイティブツール(nputopなど)がないため、次の点について質問させてください。推論の実行をNPUにオフロードした場合とCPUのみで実行した場合のCPU負荷の減少を測定することで、相対的なNPU使用率を導き出すことは妥当でしょうか?
もしこの方法が推奨されていない場合、推論実行中のNPU活動を推定するために使える代替のドライバーノードやパフォーマンスカウンターはありますか?