【发布时间】:2019-08-29 19:25:15
【问题描述】:
我正在尝试查找一个半常见的字符串并删除该列中的所有其他数据。 Pandas 和 Re 已导入。例如,我有数据框...
>>>df
COLUMN COUNT DATA
1 this row RA-123: data 8b43a
2 here RA-5372: data 94h63c
我只需要保留 RA-“后面的编号”并删除之前和之后的所有内容。后面的数字并不总是相同的长度,“RA-”字符串并不总是出现在相同的位置。每个实例后面都有一个冒号,可以用作分隔符。
我试过这个(一个朋友为我写了正则表达式搜索,因为我不熟悉它)。
df.assign(DATA= df['DATA'].str.extract(re.search('RA[^:]+')))
但是python返回了
TypeError: search() missing 1 required positional argument: 'string'
我在这里缺少什么?提前致谢!
【问题讨论】:
-
不需要
re,只需将正则表达式传递给extract
标签: python python-3.x regex pandas dataframe