【发布时间】:2019-08-15 03:45:22
【问题描述】:
我有两个数据框,比如说 df1 和 df2。两个数据框都具有名为 URL 和 Age 的相同列。我想检查df2 ['URL']中的df1 ['URL'],然后用df1 ['Age']替换匹配行的df2 ['Age'],并将其余行保留在df2中而不做任何更改。
df1
URL Category Age
google.com [IAB19, Technology & Computing] A
youtube.com [IAB25, Non-Standard Content] H
facebook.co [IAB14, Society] A
amazon.com [IAB22, Shopping] M
wpedia.org [IAB5, Education] E
df2
URL Category Age
google.com [IAB19, BBCA] T
youtube.com [IAB25, AACB] T
facebook.co [IAB14, HLGB T
amazon.com [IAB22, ETCL] T
wpedia.org [IAB5, J TCL] T
example1.com [LHTB, 2213] A
example2.com [OPCL, 9909] A
example3.com [PPRS, 7656] A
现在,我想检查 df2['URL'] 中是否存在 df1['URL'] 中的任何 URL,我想用 df1['Age'] 替换 df2['Age'] 并保持不常见URLS 没有任何变化。
因此,预期的输出将是:
df3
URL Category Age
google.com [IAB19, BBCA] A
youtube.com [IAB25, AACB] H
facebook.co [IAB14, HLGB A
amazon.com [IAB22, ETCL] M
wpedia.org [IAB5, J TCL] E
example1.com [LHTB, 2213] A
example2.com [OPCL, 9909] A
example3.com [PPRS, 7656] A
【问题讨论】: