【问题标题】:Stanford Core NLP Sentiment Analysis: Training with my own data斯坦福核心 NLP 情绪分析:使用我自己的数据进行训练
【发布时间】:2017-05-23 07:10:12
【问题描述】:

我正在使用 coreNLP 进行情绪分析,我对使用自己的数据集进行训练有一些疑问,如果有人能给我一些想法,那将是一个很大的帮助。

根据https://nlp.stanford.edu/sentiment/code.html训练自己的数据集

java -mx8g edu.stanford.nlp.sentiment.SentimentTraining -numHid 25 -trainPath train.txt -devPath dev.txt -train -model model.ser.gz

什么是 dev.txt,我需要在这个文件中添加什么数据?我还检查了 PTBTokenizer 类,但我没有找到任何 text2PTB 令牌,所以我可以训练我的数据?

谁能告诉我如何使用我的数据进行训练?

例如测试数据

  • “我一点也不难过”“中性”
  • “这个世界真美”“正能量”
  • “这个世界到处都是坏人”“负面”

【问题讨论】:

  • 这是一个小细节,但我相信你的意思是coreNLP

标签: stanford-nlp


【解决方案1】:

我找到了适合我的答案,打电话

java -cp "*" -mx5g edu.stanford.nlp.sentiment.BuildBinarizedDataset -input sample.txt

sample.text 将包含训练数据, 例子 1 今天不是个好日子。 3 好 3美好的一天 3美好的一天 这将产生

(1 (1 今天) (1 (1 (1 (1 is) (1 not)) (3 (1 a) (3 (3 good) (1 day)))) (1 .)))

【讨论】:

猜你喜欢
  • 1970-01-01
  • 2014-04-30
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多