【问题标题】:Measure the utilization of nvidia gpu测量nvidia gpu的利用率
【发布时间】:2020-11-08 02:24:59
【问题描述】:

我正在寻找在 GPU 级别记录利用率的方法。我对利用率有两个定义,乐观地我希望能够同时计算两者:

  1. GPU 在一个时间实例中运行/使用的 cuda 内核数。
  2. 每秒 FLOPS 的峰值效率数。

我知道有一些工具,但它们都没有提供任何信息。例如:

  • Nvidia-smi 的利用率显示时间内核的时间百分比,无论有多少内核和此执行的速度,对于 nvtop 和 gpustat 等工具也是如此。

  • Tensor-Flow Profiler 和 nvprof 等分析器显示了 FLOP 方面的效率,但在内核/程序级别上,并且与并行运行多个的效果无关。

我对工具和基于代码的解决方案持开放态度。

【问题讨论】:

    标签: cuda gpu nvidia utilization


    【解决方案1】:

    我可能错了,但我相信 nvprof 可以向您展示这些细节。您必须为时间线和指标运行它

    nvprof --export-profile timeline.prof <your_bin>
    nvprof --metrics all --export-profile metrics.prof <your_bin> 
    

    然后您可以将文件(在此示例中为 timeline.prof 和 metrics.prof)导入到 nvdia 可视分析器中,该分析器可以使用nvvp 打开。

    【讨论】:

    • nvprof 仅显示峰值效率。但这不会监控 GPU 状态本身,它会分析编写的代码。无论有多少应用程序/线程正在运行,我都需要在 GPU 级别监控这些变量。
    猜你喜欢
    • 2012-02-29
    • 1970-01-01
    • 2013-05-13
    • 2018-07-04
    • 2020-11-27
    • 2011-07-02
    • 2019-09-25
    • 2019-09-26
    • 1970-01-01
    相关资源
    最近更新 更多