【发布时间】:2018-05-11 00:45:03
【问题描述】:
我尝试在不删除实际单词的情况下删除单词开头带有 \t 和 \r 的单词。
例如"\tWant to go to the mall.\rTo eat something."
我在三天内尝试了 SO 的一些东西。它是一个 Pandas 数据框,所以我认为这个答案是最好的:
Pandas DataFrame: remove unwanted parts from strings in a column
但是根据我自己的解决方案来制定是行不通的。
i = df['Column'].replace(regex=False,inplace=False,to_replace='\t',value='')
我不想使用正则表达式,因为我试图去掉'\t',如果可能的话也去掉'\r'。
这是我的正则表达式:https://regex101.com/r/92CUV5/5
【问题讨论】:
-
也许正则表达式毕竟不是那么糟糕:
df['Column'].replace(regex=True,inplace=False,to_replace='\\t|\\r',value='') -
试试
str.replace:df['Column'] = df['Column'].str.replace(r'\\[tr]','')。但是,它可能仍会影响某些字符串,例如 URL。
标签: python regex dataframe character