【问题标题】:Using pandas how I can count the line occurrences in a csv file Python使用熊猫我如何计算 csv 文件 Python 中的行出现次数
【发布时间】:2018-11-30 17:50:03
【问题描述】:

这里是文件输入:File Input

使用上述文件,我如何使用 pandas 计算 csv 文件中的行出现次数,并在另一个文件中写入附加计数?并应删除其余的重复行。

例如:

0   1   1   1   -1  -1  -1  1   yesno
0   1   -1  -1  1   1   1   -1  no
0   1   -1  -1  -1  -1  -1  -1  yes
0   1   1   1   -1  -1  -1  1   yesno
1   0   1   1   -1  -1  -1  1   yesno
1   0   1   1   1   -1  -1  -1  yesno
1   0   1   1   1   -1  -1  -1  yesno
0   1   1   1   -1  -1  -1  1   yesno
0   1   -1  -1  1   1   1   -1  no
0   1   -1  -1  -1  -1  -1  -1  yes
0   1   1   1   -1  -1  -1  1   yesno
1   0   1   1   -1  -1  -1  1   yesno
1   0   1   1   1   -1  -1  -1  yesno
1   0   1   1   1   -1  -1  -1  yesno

输出应该是

0   1   1   1   -1  -1  -1  1   yesno 2
0   1   -1  -1  1   1   1   -1  no 2
0   1   -1  -1  -1  -1  -1  -1  yes 2
0   1   1   1   -1  -1  -1  1   yesno 2
1   0   1   1   -1  -1  -1  1   yesno 2
1   0   1   1   1   -1  -1  -1  yesno 2
1   0   1   1   1   -1  -1  -1  yesno 2

【问题讨论】:

  • 请定义“计数”。
  • 计算完整文件中的行并删除重复项并写下csv行之前出现的次数。希望你明白了。
  • @jpp 您可以查看我在问题中定义的示例
  • yesno / no / etc 最后一列是否包含在确定重复中?
  • @jpp 是的,这是最后一个

标签: python pandas csv python-3.5


【解决方案1】:

你可以这样做

df.groupby(df.columns.tolist(),as_index=False).size()

请看这个 How to count duplicate rows in pandas dataframe?

一旦你有了这个,你就可以将它写入文件或做任何需要的事情。

【讨论】:

    猜你喜欢
    • 2019-02-22
    • 1970-01-01
    • 1970-01-01
    • 2019-09-01
    • 1970-01-01
    • 1970-01-01
    • 2022-01-18
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多