【发布时间】:2021-12-05 18:37:58
【问题描述】:
我有一个这样的熊猫数据框:
Id A B C D
1 a b c d
2 a b d
2 a c d
3 a d
3 a b c
我想通过使用相同 ID 的信息,使用其他行中包含的值来聚合列 B-C 和 D 的空值。
生成的数据框应如下所示:
Id A B C D
1 a b c d
2 a b c d
3 a b c d
对于相同的 ID,第一列 (A) 中可能有不同的值。在这种情况下,我宁愿放置另一个值来指示此事件,而不是放置第一个实例。
所以例如
Id A B C D
1 a b c d
2 a b d
2 x c d
变成:
Id A B C D
1 a b c d
2 f b c d
【问题讨论】:
-
为什么
x变成f? -
'f' 是随机值吗,因为 ID 2 的 a 和 x 不同?
-
可能是
a和x之间的平均值? -
F 只是一个代表“这个 id 在 A 列中有 2 个不同的值”的值,只是一个标志。 F 当一个 id 在不同行的 A 列中具有不同的值时
标签: python pandas dataframe aggregate na