【发布时间】:2014-09-10 00:00:51
【问题描述】:
嗨,有没有一种有效的方法可以在非常大的文件中标记词性?
import pandas as pd
import collections
import nltk
tokens=nltk.word_tokenize(pandas_dataframe)
tag1=nltk.pos_tag(tokens)
counts=collections.counter([y for x,y in tag1])
我正在尝试在文件中查找最常见的词性,但不知道有更好的方法
【问题讨论】: