【发布时间】:2013-04-30 12:35:42
【问题描述】:
大家好, 我开始按照 NLTK 团队的官方书籍学习 NLTK。
我在第 5 章-“标记”中-我无法解决 PDF 版本第 186 页的练习之一:
给定由 cfd2['VN'].keys() 指定的过去分词列表,尝试收集该列表中紧接在项目之前的所有单词标签对的列表。
我试过这样:
wsj = nltk.corpus.treebank.tagged_words(simplify_tags=True)
[wsj[wsj.index((word,tag))-1:wsj.index((word,tag))+1] for (word,tag) in wsj if word in cfd2['VN'].keys()]
但它给了我这个错误:
Traceback (most recent call last):
File "<stdin>", line 1, in <module>
File "/usr/local/lib/python2.7/dist-packages/nltk/corpus/reader/util.py", line 401, in iterate_from
for tok in piece.iterate_from(max(0, start_tok-offset)):
File "/usr/local/lib/python2.7/dist-packages/nltk/corpus/reader/util.py", line 295, in iterate_from
self._stream.seek(filepos)
AttributeError: 'NoneType' object has no attribute 'seek'
我认为我在访问 wsj 结构时做错了什么,但我不知道出了什么问题!
你能帮帮我吗?
提前致谢!
【问题讨论】: