【发布时间】:2012-10-11 20:06:44
【问题描述】:
如何使用 stanford 解析器标记 java 类中的字符串?
我只能找到 documentProcessor 和 PTBTokenizer 从外部文件中获取文本的示例。
DocumentPreprocessor dp = new DocumentPreprocessor("hello.txt");
for (List sentence : dp) {
System.out.println(sentence);
}
// option #2: By token
PTBTokenizer ptbt = new PTBTokenizer(new FileReader("hello.txt"),
new CoreLabelTokenFactory(), "");
for (CoreLabel label; ptbt.hasNext(); ) {
label = (CoreLabel) ptbt.next();
System.out.println(label);
}
谢谢。
【问题讨论】:
标签: tokenize stanford-nlp