【发布时间】:2019-06-20 12:40:13
【问题描述】:
这不是重复的:
Fastest way to perform complex search on pandas dataframe
注意:pandas 版本 0.23.4
假设:数据可以按任何顺序排列。
我有一个清单:
L = ['A', 'B', 'C', 'D', 'L', 'M', 'N', 'O']
我也有一个数据框。 Col1 和 Col2 有几个相关的列,其中包含我希望保留的相关信息。信息随意,我没有填写。
Col1 Col2 Col1Info Col2Info Col1moreInfo Col2moreInfo
A B x x x x
B C
D C
L M
M N
N O
我正在尝试对列表中的每个元素执行“搜索和分组”。例如,如果我们对列表中的元素“D”执行搜索,则会返回以下组。
To From Col1Info Col2Info Col1moreInfo Col2moreInfo
A B x x x x
B C
D C
我一直在玩networkx,但它是一个非常复杂的包。
【问题讨论】:
-
你听说过
union-find问题吗? -
您的列表
L和 df 的相关性如何?你如何得出你得到的结果?您尝试过的 networkX 的复杂代码在哪里,但不起作用?这段代码有什么问题? -
@PatrickArtner 此列表包含我想要“分组”的所有元素。我的想法是一旦我得到一个组,我会从列表中删除该组的所有元素并继续前进。