【发布时间】:2018-11-09 00:54:01
【问题描述】:
我已经训练了一个lstm mode,并将模型加载到我的 C 项目中以预测我的数据。我发现 GPU 比 CPU 慢。
这是我的配置:
- gpu:nvidia TITAN X
- CUDA:9.0
- cudnn:7.0
- cpu: 英特尔 E5
- 张量流:1.11.0
我预测了大约200个数据项,每个数据项都调用函数:
TF_SessionRun(sess,
nullptr, // Run options.
&input_op, &input_tensor, 1, // Input tensors, input tensor values, number of inputs.
&out_op, &output_tensor, 1, // Output tensors, output tensor values, number of outputs.
nullptr, 0, // Target operations, number of targets.
nullptr, // Run metadata.
status // Output status.
);
每次 GPU 都比 CPU 慢。
我的方法错了吗?
有没有办法提高速度?
我可以批量输入数据进行预测吗?如果可以,如何输入?
这是 c_api.h enter link description here
【问题讨论】:
-
我不知道 C 有 tensorflow,我一直以为它是一个 python 库。这无助于回答您的问题,但感谢您提出问题 :)
标签: c++ c api tensorflow