【发布时间】:2014-11-09 15:01:44
【问题描述】:
我有一个来自斯坦福的电影评论数据集 - Movie Review Dataset。它既有训练数据也有测试数据——它们都是文本文件,位于 2 个文件夹中——正面和负面。
如何在上面使用 SVM 算法实现文本分类? (使用 Python 库)
【问题讨论】:
我有一个来自斯坦福的电影评论数据集 - Movie Review Dataset。它既有训练数据也有测试数据——它们都是文本文件,位于 2 个文件夹中——正面和负面。
如何在上面使用 SVM 算法实现文本分类? (使用 Python 库)
【问题讨论】:
检查scikit-learn,这是一个很棒的机器学习框架。看看Working With Text DataClassification of text documents using sparse features example,Feature extractions。
还有 NTLK,但在你的情况下它不是很强大,请查看此线程以获取更多信息details。
【讨论】: