【发布时间】:2013-11-25 12:22:15
【问题描述】:
我有一个 pandas 数据框,看起来像
example_df = pd.DataFrame({"class": ["A", "A", "A", "B", "B", "B"], "id": [1,2,3,4,5,6], "value": [100, 100, 101, 101, 102, 103]})
example_df
class id value
0 A 1 100
1 A 2 100
2 A 3 101
3 B 4 101
4 B 5 102
5 B 6 103
我想知道,对于每个class A 或 B,它的 values 有多独特;也就是说,它与其他类共享多少值。 (您可以假设只有两个类。)例如,给定上面的数据框,A 与B 共享一个值。
通过将列分解为sets 并手动计算交叉点来做到这一点并不难,但这不是很好。在 pandas 中是否有一种优雅的方式来做到这一点?
【问题讨论】: