【问题标题】:Regular expression to match characters inside a word [duplicate]正则表达式匹配单词中的字符[重复]
【发布时间】:2020-06-01 20:51:17
【问题描述】:

我正在做Pig Latin文本转换:

其中一个要求是将qu 放在一起。

我做了什么re.findall(r'^qu', token)

但如果单词/令牌以 qu 开头,它只接受 qu 一起

如果单词/标记以aqu 开头,则它不能同时识别qu

我想要的是识别qu,无论其位置如何,包括它是否以Qu开头。

我该如何解决这个问题?

【问题讨论】:

  • 删除插入符号。而不仅仅是qu,也许是:[Qq]u。是否需要正则表达式?

标签: python regex python-3.x nltk nltk-book


【解决方案1】:

从中删除^,导致此问题。插入符号基本上意味着“从行首开始匹配(在您的情况下为标记)”。

【讨论】:

  • 这应该可以。只是贡献一点,当我必须使用正则表达式时,我总是使用regexr.com 来检查我是否做对了。你可以在 google 上找到一些类似的网站。
猜你喜欢
  • 1970-01-01
  • 2016-03-17
  • 1970-01-01
  • 2013-10-12
  • 2019-09-29
  • 1970-01-01
  • 2021-05-23
  • 1970-01-01
  • 2011-12-13
相关资源
最近更新 更多