【发布时间】:2011-08-27 22:11:51
【问题描述】:
我想使用正则表达式从多行字符串中删除所有空白字符。 我正在寻找的是这样的:
exp = re.compile("\s-[\r\n]")
exp.sub('', text)
是否有执行上述操作的正则表达式。由于text 是unicode,除了[\t\v\f \r\n] 之外,还有可能形成\s 类的其他字符,我不能使用[\t\v\f ]。
【问题讨论】:
-
顺便说一句 - 我不是 Python 了解的人,但你不应该使用
re.U吗? -
关于
re.U,我以为输入文本为unicode时python会自动使用。现在我所有的数据都是英文的,所以我不知道除了上述之外是否还有其他空白字符。我刚刚从 python 文档中遇到了\s中的字符列表。当我想到 unicode 问题时,我真的在尝试使用提到的正则表达式[\t\v\f ]来满足我的需要。如果您知道除上述之外的任何 unicode 空白字符,请告诉我,我会检查是否需要使用re.U。
标签: python regex newline whitespace removing-whitespace