【问题标题】:python/regex copy paragraphs in order to another txt documentpython/regex 将段落复制到另一个 txt 文档
【发布时间】:2021-11-16 10:30:11
【问题描述】:

我正在开发我最初认为会非常简单的程序。本质上,它应该找到关键词,然后将该段落复制到另一个文档中。我想要做的是从文档 1 中获取内容(都是 .txt 文件)并将段落重新排序为所需的顺序。

我认为我已经正确编写了我的 python 部分,因为它可以与其他 sn-ps 一起使用(或者似乎很好),但是由于某种原因,正则表达式部分(诚然我对此很陌生)不起作用. 我已经尝试了很多事情并通过堆栈溢出进行了搜索。我目前“捕获”的内容几乎是整个 txt 文件,而不仅仅是段落。这可能是显而易见的,但除了捕获文档的大部分内容之外,它还捕获了其中没有目标术语(在本例中为讨论)的段落。

提前感谢所有帮助。


def write_function():
    with open('minnar.txt','r') as rf, open('regexoutput.txt', 'a') as wf:
        content = rf.read()
        matches = target.findall(content)
        print(matches)
        for match in matches:
            wf.write(match + '\n \n')

target = re.compile('([^\']*(?=discussing)[^\']*)')
write_function()```

【问题讨论】:

  • 这里的“段落”到底是什么意思?段落之间是如何分隔的(只是换行符、空行……)?

标签: python regex string text


【解决方案1】:

【讨论】:

  • 但它只应该匹配一个包含单词discussing的段落
  • 我很抱歉。当我说复制一个段落时,我的意思是两个空行之间的所有文本。是的,正如@barmar 所说,在这种情况下,它找到讨论并选择该“段落”(或在空行之间组合在一起的行) )。
  • 谢谢大家。我想我明白了。我所要做的就是在正则表达式的前面和后面添加 \n ,现在它似乎只拉了两个匹配项。
猜你喜欢
  • 1970-01-01
  • 2013-12-11
  • 2019-10-08
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2021-05-26
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多