【发布时间】:2019-07-24 19:01:47
【问题描述】:
鉴于以下两个熊猫数据框df1 和df2,我试图从df1["a"](字符串)中删除与df2["z"] 的所有条目中的任何字符串都不匹配的所有行。
df1 = pd.DataFrame({'a' : ['use social tag', 'dubmod intern workshop data',
'deep collabor filter', 'pathrank a novel node rank'],
'b' : ["test", "test2" ,"test3", "test4"]})
df1
a b
0 use social tag test
1 dubmod intern workshop data test2
2 deep collabor filter test3
3 pathrank a novel node rank test4
df2 = pd.DataFrame({'z' : ['experiment', 'dubmod intern workshop data',
'deep collabor filter', 'experiment3']})
df2
z
0 experiment
1 dubmod intern workshop data
2 deep collabor filter
3 experiment3
结果应该是这样的:
a b
0 dubmod intern workshop data test2
1 deep collabor filter test3
【问题讨论】:
-
不要认为正则表达式是工作的工具
-
df1.merge(df2.rename(columns={'z': 'a'}))。是完全匹配的吧?
标签: python python-3.x string pandas