【发布时间】:2020-07-10 18:02:19
【问题描述】:
我有一个正面和负面内容的数据集。所以让我们假设它是一个垃圾邮件项目。
我需要建立一个模型,它可以对 pos/neg 中的内容进行分类。所以我正在做一个有监督的学习任务,因为我有一个标记的数据集。因此,最好的选择必须是使用 SVC 模型。
到目前为止一切顺利。
现在复杂的部分来了。
我想通过使用 Keras LSTM 模型来解决相同的任务。所以我的问题:
它仍然是有监督的还是无监督的,因为我在这个任务中使用了词嵌入,在这里参考这篇文章,词嵌入用于无监督的任务:https://www.quora.com/Is-deep-learning-supervised-unsupervised-or-something-else
上面写着:
深度学习可以是无监督的:词嵌入、图像编码 进入更低或更高维度等。
那么 - 它现在是无监督的还是有监督的(因为我的数据集被标记了)?
深度学习是另一种技术,如无监督学习和监督学习,或者这些主题之间的关系如何?深度学习是使用监督和非监督技术吗?还是必须在深度学习、无监督学习和有监督学习之间做出选择?
这太令人困惑了!请帮忙!特别是对于 LSTM 任务。我需要知道它在哪里受到监督(因为标记的数据集)或无监督(因为使用了词嵌入)
提前谢谢各位!
【问题讨论】:
标签: machine-learning text-classification word-embedding unsupervised-learning supervised-learning