【问题标题】:Delete sub string between two characters of Pandas Data frame with python用python删除Pandas Dataframe的两个字符之间的子字符串
【发布时间】:2019-12-30 09:20:51
【问题描述】:

我想删除名为“RegionName”的列的“()”和“[]”之间的字符。 DataFrame的图片如下。Screenshort of dataframe 请告诉我该怎么做!

【问题讨论】:

  • df['RegionName'].str.replace(...)
  • 您想要保留括号和方括号还是删除它们?
  • @Zubair Hossian 删除它们之间的字符后是否要保留 () 和 []
  • @Erfan 我需要你所做的一切。谢谢。
  • @min2bro 不,我不想保留 () 或 []。

标签: python-3.x pandas data-science data-cleaning


【解决方案1】:

str.replace 与正则表达式运算符一起使用,删除第一个( 字符之后的所有内容:

输入数据

                                RegionName
0            Auburn (Auburn University)[1]
1  Florence (University of Nother Alabama)

输出

df['RegionName'].str.replace('\(.*$', '')

0      Auburn 
1    Florence 
Name: RegionName, dtype: object

【讨论】:

    【解决方案2】:

    如果你想在删除字符后删除 () 和 [],那么你可以使用替换和正则表达式来完成

    df.replace("[\(\[].*?[\)\]]", "",regex=True)
    

    输入:

    Auburn(Auburn University)[1]
    

    输出:

    Auburn
    

    【讨论】:

      猜你喜欢
      • 2012-05-14
      • 2020-10-12
      • 1970-01-01
      • 2018-11-25
      • 2018-03-16
      • 2016-07-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多