【发布时间】:2020-06-05 19:46:27
【问题描述】:
我有一个大约 1000 行的数据框,我的要求是将出现在 username: 之后的所有字符替换为一个通用字符串(比如“用户”)。
我正在使用以下适合我的问题的正则表达式,我可以匹配第二组中我想用“用户”替换的所有用户名
正则表达式:
"(?i)(\busername\b\s?|\buname\s?)+[;|:]
(\s?[a-z-A-Z0-9@:!+=#$%^&*-]{5,})"
测试数据:
username : user111
uname : user212
预期输出:
username : users
uname : users
我还想在大型数据集上执行此操作,因此我正在寻找是否有任何有效的方法来实现此目标。
【问题讨论】:
标签: python regex pandas dataframe