【发布时间】:2020-01-22 11:49:40
【问题描述】:
我正在使用 python with spark 来处理一些带有葡萄牙语重音词的数据。
一些数据来的例子是这样的:
.. -- Água, 1234 ...
- -- https://www.example.com/page.html *****
我正在尝试从字符串的左侧或右侧删除不是单词或数字的任何内容,得到如下干净的结果:
Água, 1234
https://www.example.com/page.html
我能做的最好的就是:
^[^\\p{N}\\p{L}]]|[^\\p{N}\\p{L}]$
但这没有用。我看到了很多解决方案,但没有将字符串的开头和结尾与重音字符匹配。
提前致谢。
【问题讨论】:
-
REGEXP[a-zA-Z]和[0-9]怎么样 -
把重音词去掉,如果它们在开头或结尾
-
嘿,我不知道您为什么删除了您的评论,但它确实有效,谢谢 :)