【发布时间】:2016-03-08 11:20:35
【问题描述】:
我有一个数据框,这是其中的一部分。
CodeID Codes
0 'code1' '[code1(a,b,c)][code2(c,d,e)][code3(e,f,g)]' ...
1 'code2' '[code1(a,b,c)][code2(c,d,e)][code3(e,f,g)]' ...
2 'code3' '[code1(a,b,c)][code2(c,d,e)][code3(e,f,g)]' ...
...
我要做的是提取列Codes中与模式r"\[<code in CodeID column>[^][]*\]"匹配的字符串部分
类似:
df['Code'] = df['Codes'].str.find(r"\[<code in CodeID column>[^][]*\]")
This recent question 似乎暗示以矢量化的方式不可能,但情况并不完全相同。
【问题讨论】:
-
如果可能的话,正则表达式看起来像
r"\[<code in CodeID column>[^][]*\]" -
谢谢。我总是对正则表达式视而不见,把调试的那部分留到最后!