【发布时间】:2021-10-16 01:14:24
【问题描述】:
我是 python 初学者。
我有这段代码可以获取符号“*****”之后的所有段落
import re
file = open('/Users/simon/DRIVE/ARCHIVED/Tools at Hand/PASTE.txt', mode='r')
result = [s.strip() for s in re.findall(r'^\*{4,}((?:\r?\n(?!\s*$|\*{4}).+)*)', file.read(),
re.MULTILINE)]
print(result)
file.close()
输入:
Lorem ipsum dolor sit amet, consectetur adipiscing elit.
****
Sed id placerat magna.
*******
Pellentesque in ex ac urna tincidunt tristique.
Etiam dapibus faucibus gravida.
我需要的输出:
Sed id placerat magna.
Pellentesque in ex ac urna tincidunt tristique.
我得到的输出:
'Sed id placerat magna.', 'Pellentesque in ex ac urna tincidunt tristique.'
我似乎无法弄清楚如何在每个段落中输出每个句子。
【问题讨论】:
标签: python text extract paragraph