【发布时间】:2022-07-21 00:01:55
【问题描述】:
我有两个数据帧,其中第一个数据帧的索引从零开始。第二个数据帧具有从零开始的重复索引。我想根据它们的索引加入两个数据框。 第一个数据框是这样的
Start_Year End_Year
0 1500 1500
1 1500 1501
2 1500 1700
3 1500 1800
4 1500 1800
... ... ...
3409 2018 2018
3410 2018 2018
3411 2019 2019
3412 2019 2022
3413 2020 2020
3414 rows × 2 columns
第二个数据框是
0 [KingdomofPoland, Georgia]
0 [GrandDuchyofLithuania, Georgia]
1 [NorthernYuanDynasty, Georgia]
2 [SpanishEmpire, ChechenRepublic]
2 [CaptaincyGeneralofChile, ChechenRepublic]
...
3411 [SyrianOpposition, SpanishEmpire]
3412 [UnitedStates, SpanishEmpire]
3412 [UnitedKingdom, SpanishEmpire]
3412 [SaudiArabia, SpanishEmpire]
3413 [Turkey, Russia]
Length: 31170, dtype: object
我想根据索引加入这两个数据框,即新的数据框应该看起来像
Start_Year End_Year new_col
0 1500 1500 [KingdomofPoland, Georgia]
0 1500 1500 [GrandDuchyofLithuania, Georgia]
1 1500 1501 [NorthernYuanDynasty, Georgia]
2 1500 1700 [SpanishEmpire, ChechenRepublic]
2 1500 1700 [CaptaincyGeneralofChile, ChechenRepublic]
......
3411 2019 2019 [SyrianOpposition, SpanishEmpire]
3412 2019 2022 [UnitedStates, SpanishEmpire]
3412 2019 2022 [UnitedKingdom, SpanishEmpire]
3412 2019 2022 [SaudiArabia, SpanishEmpire]
.......
这本质上是我需要根据在第二个数据帧中重复相同索引的次数来复制数据帧 1 的行。如我们所见,在第二个数据帧中,零索引出现了两次,因此我们将数据帧 1 的零索引行复制两次,然后加入数据帧,依此类推。最后我们可以重置索引(我知道)。
我附上了两个数据框的链接以供参考。 第一个数据帧的链接https://drive.google.com/file/d/1DqxhnMM8R21Olm9zeRJeDgua_ozoRp8P/view?usp=sharing
第二个数据框的链接https://drive.google.com/file/d/1sX5xcTeovVqXtZgSZ5cTC5JRdUvaw7gd/view?usp=sharing
我不知道如何处理这些任务。请帮帮我。
【问题讨论】:
标签: python pandas dataframe numpy data-science