【发布时间】:2021-03-10 05:52:10
【问题描述】:
我正在处理两个数据框:
df1 = {'Metropolitan area': {0: 'New York City',
1: 'Los Angeles',
2: 'San Francisco Bay Area',
3: 'Chicago',
4: 'Dallas–Fort Worth'},
'token_nhl': {0: 'Devils',
1: 'Ducks',
2: 'Sharks',
3: 'Blackhawks',
4: 'Stars'}}
df2 = {'NHL': {0: 'team1', 1: 'team2', 2: 'team3', 3: 'team4', 4: 'team5'},
'token_nhl': {0: 'Devils', 1: 'Ducks', 2: 'x', 3: 'Stars', 4: 'Sharks'},
'token_nhl1': {0: 'a', 1: 'b', 2: 'Blackhawks', 3: 'c', 4: 'd'}}
我正在尝试合并它们,但我想将 df1 中的“token_nhl”列的值与 df2 中的“token_nhl”和“token_nhl1”相匹配,所以每当我在'token_nhl',我去'token_nhl1'中寻找它,然后生成的数据框将是:
{'NHL': {0: 'team1', 1: 'team2', 2: 'team3', 3: 'team4', 4: 'team5'},
'token_nhl_left': {0: 'Devils', 1: 'Ducks', 2: 'x', 3: 'Stars', 4: 'Sharks'},
'token_nhl1_left': {0: 'a', 1: 'b', 2: 'Blackhawks', 3: 'c', 4: 'd'},
'token_nhl_right': {0: 'Devils',1: 'Ducks',2: 'Blackhawks',3: 'Stars',4: 'Sharks'}}
【问题讨论】:
-
这里的'x'是指nan值吗?
-
只是表示我们不关心的随机值