【发布时间】:2020-08-02 18:16:54
【问题描述】:
我在 pandas 数据框中有一列,其中每个值都是一个长文本字符串。在该文本的某处,我可能有也可能没有带有特定前缀(“IFL”或“IFN”)的对象编号,我需要将其提取并添加为自己的列。
数据如下:
Description
12753, IFL12329-1, Supply Chain, (May)
120873, [send], 7385876, (June), IFN1228-3
预期结果:
Description Object Number
12753, IFL12329-1, Supply Chain, (May) IFL12329-1
120873, [send], 7385876, (June), IFN1228-3 IFN1228-3
前缀必须包含在新列中,困难在于它是两个不同的前缀条件,并且它们每次都位于不同的位置(有时在字符串中间,有时在末尾)。
【问题讨论】:
-
你能打印
df.head.to_dict()。像这样的列很难重现 -
这能回答你的问题吗? pandas extract regex allowing mismatches