【发布时间】:2014-03-10 19:45:27
【问题描述】:
来自python初学者的问题!我有一个 tsv 文件,如下所示:
WHI5 YOR083W CDC28 YBR160W physical interactions 19823668
WHI5 YOR083W CDC28 YBR160W physical interactions 21658602
WHI5 YOR083W CDC28 YBR160W physical interactions 24186061
WHI5 YOR083W RPD3 YNL330C physical interactions 19823668
WHI5 YOR083W SWI4 YER111C physical interactions 15210110
WHI5 YOR083W SWI4 YER111C physical interactions 15210111
我想计算第[3]行中包含相同单词的所有行,并仅输出第一个具有新列中出现次数的行。
WHI5 YOR083W CDC28 YBR160W physical interactions 19823668 3
WHI5 YOR083W RPD3 YNL330C physical interactions 19823668 1
WHI5 YOR083W SWI4 YER111C physical interactions 15210110 2
到目前为止,我尝试了 'csv' 和 'Counter' 或 'pandas' 和 'Counter' 的组合,但没有成功......
【问题讨论】:
-
您要查找的词是预定义的还是重复的?
-
我正在寻找重复项