【发布时间】:2016-09-21 00:16:50
【问题描述】:
输入:包含 5 列的 CSV。
预期输出:“col1”、“col2”、“col3”的唯一组合。
示例输入:
col1 col2 col3 col4 col5
0 A B C 11 30
1 A B C 52 10
2 B C A 15 14
3 B C A 1 91
样本预期输出:
col1 col2 col3
A B C
B C A
只是期待这个作为输出。我不需要 col4 和 col5 输出。而且也不需要任何总和、计数、平均值等。尝试使用熊猫来实现这一点,但没有运气。
我的代码:
input_df = pd.read_csv("input.csv");
output_df = input_df.groupby(['col1', 'col2', 'col3'])
此代码返回 'pandas.core.groupby.DataFrameGroupBy 对象位于 0x0000000009134278'。 但我需要像上面这样的数据框。非常感谢任何帮助。
【问题讨论】: