【发布时间】:2014-03-09 18:17:34
【问题描述】:
我查了类似的主题,但结果很差。
我有一个这样的文件:
S1_22 45317082 31 0 9 22 1543
S1_23 3859606 40 3 3 34 2111
S1_24 48088383 49 6 1 42 2400
S1_25 43387855 39 1 7 31 2425
S1_26 39016907 39 2 7 30 1977
S1_27 57612149 23 0 0 23 1843
S1_28 42505824 23 1 1 21 1092
S1_29 54856684 18 0 2 16 1018
S1_29 54856684 18 0 2 16 1018
S1_29 54856684 18 0 2 16 1018
S1_29 54856684 18 0 2 16 1018
我想计算第一列中单词的出现次数,并在此基础上编写输出文件,其中包含说明 uniq if count == 1 和 multi if count > 0 的附加字段
我生成了代码:
import csv
import collections
infile = 'Results'
names = collections.Counter()
with open(infile) as input_file:
for row in csv.reader(input_file, delimiter='\t'):
names[row[0]] += 1
print names[row[0]],row[0]
但它不能正常工作
由于文件太大,我无法将所有内容都放入列表中
【问题讨论】: