【发布时间】:2016-08-24 00:13:36
【问题描述】:
我是 LSTM 和 Tensorflow 的新手,我正在尝试使用 LSTM 模型来学习并分类我拥有的一些庞大的数据集。 (我不担心我打算学习的准确性)。 我尝试以与使用 LSTM 的 PTB 单词预测教程类似的方式实现该模型。 教程中的代码 (https://tensorflow.googlesource.com/tensorflow/+/master/tensorflow/models/rnn/ptb/ptb_word_lm.py) 使用下面一行使用模型运行会话
cost, state, _ = session.run([m.cost, m.final_state, eval_op],
{m.input_data: x,
m.targets: y,
m.initial_state: state})
我为下面的示例修改了这个(以获取 logits 并使用它):
cost, state, _,output,logits = session.run([m.cost, m.final_state, eval_op, m.output,m.logits],
{m.input_data: x,
m.targets: y,
m.initial_state: state})
所以如果有人可以提供帮助,我的问题如下:
- 如何将训练时构建的模型用于测试?什么 当教程使用 3 个模型进行每个测试、训练和验证时,到底发生了什么?
- 测试时的目标呢(如果我不知道它们,就在分类问题中说)。 run_epoch()中的哪些变化可以通过使用训练时建立的模型的方式来完成。
- 只是另一个问题:调试 tensorflow 图很困难(我发现也很难理解 tensorboard 可视化工具)而且我没有找到学习 tensorflow 的好资源(该网站似乎缺乏结构/文档)还有什么资源/调试方法有吗?
谢谢。
【问题讨论】:
-
也许,这些简单的 LSTM 示例可以解决您关于 TensorFlow 中基本 LSTM 的问题:github.com/sherjilozair/char-rnn-tensorflow 或 github.com/nlintz/TensorFlow-Tutorials/blob/master/7_lstm.py
标签: testing machine-learning tensorflow test-data lstm