【发布时间】:2021-01-04 12:06:23
【问题描述】:
对于我的文本挖掘任务,我正在尝试使用三个单独文本的字数(我已经过滤和标记化)创建一个矩阵。我知道每个文本都有这个数据框:
word count
film 82
camera 18
director 10
action 5
character 2
我还创建了一个列表,将三个文本的所有单词组合在一起,字数组合在一起,但我试图达到这样的效果:
word text1. text2. text3.
film. 82. 16. 8
camera. 18. 76. 3
director. 10. 2. 91
character. 2. 20. 0
screen. 0. 4. 10
movie. 12. 0. 0
action. 5. 23. 54
dance. 0. 1. 16
为此使用什么代码?如上面的示例所示,我想为文本中没有出现数字“0”的每个单词填写。我总共有大约 4459 个单词,文本分别有 1804、1522 和 1133 个单词。
提前非常感谢!
【问题讨论】:
标签: r merge text-mining word-count