【发布时间】:2014-08-27 15:31:28
【问题描述】:
我正在进行情绪分析,我正在使用此链接中给出的数据集:http://www.cs.jhu.edu/~mdredze/datasets/sentiment/index2.html,并且我已将我的数据集划分为 50:50 的比例。 50%作为测试样本,50%作为训练样本,从训练样本中提取特征并使用Weka分类器进行分类,但我的预测准确率在70-75%左右。
任何人都可以建议一些其他可以帮助我提高结果的数据集 - 我使用 unigram、bigram 和 POSTtags 作为我的特征。
【问题讨论】:
标签: dataset sentiment-analysis web-mining