【发布时间】:2018-03-10 08:01:35
【问题描述】:
我希望对转换为图像的 PDF 文档进行一些图像分类。我正在使用 tensorflow inception v3 pre trained model 并尝试在 tensorflow tuto 之后使用我自己的类别重新训练最后一层。我每个类别有大约 1000 个训练图像,只有 4 个类别。通过 200k 次迭代,我可以达到 90% 的成功分类,这还不错,但仍需要一些工作:
这里的问题是这个预训练模型只需要 300*300p 图像作为输入。显然,它与我试图在文档中识别的特征中涉及的字符混淆了很多。
是否可以更改模型输入层,以便我可以为他提供分辨率更高的图像?
使用自制且更简单的模型会获得更好的结果吗?
如果是这样,我应该从哪里开始为此类图像分类构建模型?
【问题讨论】:
标签: machine-learning tensorflow deep-learning image-recognition