【发布时间】:2021-11-16 10:30:11
【问题描述】:
我正在开发我最初认为会非常简单的程序。本质上,它应该找到关键词,然后将该段落复制到另一个文档中。我想要做的是从文档 1 中获取内容(都是 .txt 文件)并将段落重新排序为所需的顺序。
我认为我已经正确编写了我的 python 部分,因为它可以与其他 sn-ps 一起使用(或者似乎很好),但是由于某种原因,正则表达式部分(诚然我对此很陌生)不起作用. 我已经尝试了很多事情并通过堆栈溢出进行了搜索。我目前“捕获”的内容几乎是整个 txt 文件,而不仅仅是段落。这可能是显而易见的,但除了捕获文档的大部分内容之外,它还捕获了其中没有目标术语(在本例中为讨论)的段落。
提前感谢所有帮助。
def write_function():
with open('minnar.txt','r') as rf, open('regexoutput.txt', 'a') as wf:
content = rf.read()
matches = target.findall(content)
print(matches)
for match in matches:
wf.write(match + '\n \n')
target = re.compile('([^\']*(?=discussing)[^\']*)')
write_function()```
【问题讨论】:
-
这里的“段落”到底是什么意思?段落之间是如何分隔的(只是换行符、空行……)?