【发布时间】:2023-03-30 17:43:01
【问题描述】:
我有一个数据框 df1,看起来像 -
user data dep
1 ['dep_78','fg7uy8'] 78
2 ['the_dep_45','34_dep','re23u'] 45
3 ['fhj56','dep_89','hgjl09'] 91
我想关注值包含字符串“dep”的“数据”列,并查看附加到该字符串的数字是否与“dep”列中的数字匹配。例如,用户 1 的数据列中的 dep_78 与 dep 列中的 dep 78 匹配。我想输出不匹配的行。所以结果应该给我-
user data dep
2 ['the_dep_45','34_dep'] 45
3 ['dep_89'] 91
问题是仅在数据列中使用字符串“dep”获取特定值,然后将这些字符串附带的数字与“dep”列进行比较。
【问题讨论】:
-
“data”列中所有包含“dep”的字符串所附的数字应与“dep”列中的数字相匹配。数据中的 dep_89 与 dep 列中的 91 不匹配。
-
看手机是我的错,我错过了第一个街区的
dep。不过,我认为您的第一步是拆分data中的字符串?为什么首先要有这种格式的数据框? -
您能否为您的问题提供一些背景信息?你都尝试了些什么?为什么不按照here 的建议重构您的数据框?
标签: python pandas numpy jupyter-notebook