【发布时间】:2016-01-09 11:24:06
【问题描述】:
我是 NLTK 的新手,我想为我的玩具项目试验语法解析器。
这是我使用的代码:
tokens = nltk.regexp_tokenize(test_sentence, ptrn_for_tokenizer, flags = flags )
tagged_text = regexp_tagger.tag(tokens)
only_tags = [tag for text, tag in tagged_text]
grammar = CFG.fromstring(GRAMMAR)
parser = nltk.ChartParser(grammar, trace=0)
trees = parser.parse(only_tags)
所以我用正则表达式标记文本,然后使用其他正则表达式标记文本,最后我使用解析器来生成语法树。但是解析只使用标签(only_tags)完成,我无法恢复标记的文本。
如何做到这一点?是不是走错路了?
【问题讨论】:
-
mhhh...没有答案没有 cmets。愚蠢的问题?