【发布时间】:2017-05-23 07:10:12
【问题描述】:
我正在使用 coreNLP 进行情绪分析,我对使用自己的数据集进行训练有一些疑问,如果有人能给我一些想法,那将是一个很大的帮助。
根据https://nlp.stanford.edu/sentiment/code.html训练自己的数据集
java -mx8g edu.stanford.nlp.sentiment.SentimentTraining -numHid 25 -trainPath train.txt -devPath dev.txt -train -model model.ser.gz
什么是 dev.txt,我需要在这个文件中添加什么数据?我还检查了 PTBTokenizer 类,但我没有找到任何 text2PTB 令牌,所以我可以训练我的数据?
谁能告诉我如何使用我的数据进行训练?
例如测试数据
- “我一点也不难过”“中性”
- “这个世界真美”“正能量”
- “这个世界到处都是坏人”“负面”
【问题讨论】:
-
这是一个小细节,但我相信你的意思是
coreNLP
标签: stanford-nlp