【发布时间】:2020-06-18 00:50:31
【问题描述】:
我正在尝试使用 python 和 pandas 处理 Excel 文件。这个文件有大量的列和行,但我会尝试使用这个例子来简化:
Name Age Nationality Name1 Age1 Nationality1 Name2 Age2 Nationality2
Jane 32 Canada
Pedro 25 Spain
Lucas 30 Italy
Ana 23 Germany
Pedro 43 Brazil
Lucas 32 Mexico
因此,在此示例中,我有以下列:姓名、年龄和国籍。但是,我也有 Name1、Age1 和 Nationality1。因为我想按其值过滤它,所以它不起作用,因为我必须过滤每一个:Name、Name1 和 Name2。
我认为这可能是转换为不同字典并尝试过滤这些字典的一个选项。但考虑到列和行的数量,我想这需要更长的时间。
如果我可以重命名列,我也很困难,但是我搜索并发现它必须具有唯一的名称。如果我错了,请纠正我。
有人对此有解决方案吗?会很有帮助。 提前谢谢
【问题讨论】:
-
列 always 是否按顺序排列 - 即
Name, Age, Nationality?会不会是Name, Age, Nationality, Nationality1 ,Age1, Name1 -
您能否发布一个您希望输出的示例。
-
@Datanovice,不完全是..我想我的问题可以更清楚..抱歉。但是假设我们也可以有“昵称,性别”。但那些不会重复,它们在序列之间:“姓名,年龄,国籍”“昵称”“姓名1,年龄1,国籍1”“性别”“姓名2 , 年龄2, 国籍2"
-
@Chris,我希望只有一行用于 Name,另一行用于 Age,另一行用于 Nationality.. 这样我就可以按名称过滤,例如:“Pedro”。然后我会有两个结果。一个来自西班牙,有 25 岁,另一个来自巴西,有 43 岁。如果我想知道有多少人被称为 pedro,并且在这个数据表中来自西班牙,我可以再次按年龄或国籍进行过滤。
-
@Phil 你能添加一些模仿你上面所说的数据样本吗?