【发布时间】:2021-02-26 01:03:50
【问题描述】:
我正在尝试从以下数据框中提取国家/地区名称
country
0 NaN
1 Country: America
2 Country: France ...More CountriesFranceNorwayP...
3 NaN
4 Country: India
使用下面的正则表达式
import re
regex = re.compile(\
r"Country: (?P<country>\w+)"
)
df['country'] = df['country'].str.extractall(regex).droplevel(1)
但它会返回
country
0 NaN
1 NaN
2 NaN
3 NaN
4 NaN
而不是返回
country
0 NaN
1 America
2 France
3 NaN
4 India
我错过了什么?
请指教
【问题讨论】: