【发布时间】:2020-11-08 22:15:30
【问题描述】:
我有一个数据框列“review”,其中包含“Food was Awesome”之类的内容,我想要一个新列来计算每个单词的重复次数。
name The First Years Massaging Action Teether
review A favorite in our house!
rating 5
Name: 269, dtype: object
期望像 ['Food':1,'was':1,'Awesome':1] 这样的输出 我尝试使用 for 循环,但执行时间太长
for row in range(products.shape[0]):
try:
count_vect.fit_transform([products['review_without_punctuation'][row]])
products['word_count'][row]=count_vect.vocabulary_
except:
print(row)
我想不使用 for 循环。
【问题讨论】:
-
为什么
fit每一行而transform单独一行? -
我只是试了一下..我想不为每一行做
标签: pandas scikit-learn countvectorizer