【发布时间】:2011-10-19 17:50:42
【问题描述】:
根据CUDA Programming Guide,第 122 页,只要我们使用计算架构 2.x,就可以在 device/global 函数内动态分配内存。
我的问题是,当我尝试这样做时,我收到了命令行消息:
命令“一些命令” -gencode=arch=compute_10,code=\"sm_10,compute_10\" -gencode=arch=compute_20,code=\"sm_20,compute_20\" 等...
随后出现一个错误,指出您无法从 device/global 函数调用主机函数 (malloc)。
上面的消息表明它正在尝试在计算 1.x 下编译。我正在使用 VS2010 并在“CUDA C/C++”属性页中将“代码生成”设置为“compute_20,sm_20”,所以我不确定为什么它仍在尝试在计算 1.x 下编译。我肯定在使用支持 2.x 的卡。有什么想法吗?
【问题讨论】:
标签: c visual-studio-2010 cuda parallel-processing