【发布时间】:2017-04-30 21:05:02
【问题描述】:
我有一个包含 4 列 {Tag、User、Quality、Cluster_id} 的 csv 文件。使用 python 我想做以下事情:对于每个 cluster_id(从 1 到 500),我想查看每个用户的好标签和坏标签的数量(从质量列获得)。有超过6000个用户。我只能在 csv 文件中逐行读取。因此,我不确定如何做到这一点。
例如:
Columns of csv = [Tag User Quality Cluster]
Row1= [bag u1 good 1]
Row2 = [ground u2 bad 2]
Row3 = [xxx u1 bad 1]
Row4 = [bbb u2 good 3]
我刚刚设法获取了 csv 文件的每一行。
我一次只能访问每一行,没有两个 for 循环。我要实现的算法的伪代码是:
for cluster in clusters:
for user in users:
if eval == good:
good_num = good_num +1
else:
bad_num = bad_num + 1
【问题讨论】:
-
一些演示数据会有所帮助。
-
这里的问题应该是经过你的努力后才提出来的,你有什么尝试?
-
我已经编辑了我的问题,希望能更清楚
-
我对stackoverflow中的格式化不熟悉,但我已经尽力解释了这个问题。
-
我修复了 Python 代码中的格式。