【问题标题】:why the difference in cuda cores between nvidia control panel and device query?为什么 nvidia 控制面板和设备查询之间的 cuda 核心不同?
【发布时间】:2015-11-24 08:38:05
【问题描述】:

Q1:为什么我从 Nvidia 控制面板->系统信息和 cuda sdk 中的设备查询示例中获得的信息不同。

系统信息:

  • cuda核心384核心
  • 内存数据速率 1800MHz

设备查询输出:

  • cuda 核心 = 2 MP x 192 SP/MP = 576 个 cuda 核心
  • 内存时钟频率 900MHz

Q2:如何使用设备查询数据计算我的 GPU 的 GFLOPs? 我发现最常用的公式是提到的here,它建议使用 Number of mul-add units, number of mul units which I don't know?

最大 GFLOPS(核心 x SIMD x ([mul-add]x2+[mul]*1)*clock speed)

【问题讨论】:

  • Q1 的答案就在您发布的第二个屏幕截图中。您使用的 deviceQuery 实用程序太旧,并且假定每个 SMM 的内核数不正确(192 而不是 128)。

标签: cuda gpu nvidia


【解决方案1】:

Q1:它告诉你就在这条线的正上方......

SM 5.0 的 MapSMtoCores 未定义。默认使用 192 Cores/SM

GeForce 840M 背后的架构 Maxwell 每个“SMM”使用 128 个“内核”

3 * 128 = 384

Q2:"Cores" * frequency * 2(因为每个核心都可以做乘法+加法)

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2021-12-14
    • 2023-03-23
    • 1970-01-01
    • 2017-12-30
    • 1970-01-01
    • 2019-04-13
    • 1970-01-01
    相关资源
    最近更新 更多