【发布时间】:2016-02-01 20:27:27
【问题描述】:
我有这个:
myText = str(^123"I like to"^456&U"play video games and"$"eat cereal")
我想提取引号之间(包括引号)之间的所有内容,拆分$ 符号之前和之后的所有内容,并将它们附加到嵌套列表中。例如
myTextList = [["我喜欢","玩电子游戏和"],["吃麦片"]]
这是我尝试过的:
tempTextList = []
for text in re.findall('(?<=\$)"[^"]*"(?<!\^)',myText,re.DOTALL)
tempTextList.append(text)
myTextList.append(tempTextList)
我使用了https://www.regex101.com/#python 网站并尝试了几乎所有我能想到的...
(?!\$)"(?!\^\00\+\-\&)[^"].*"
等等……
re.findall 部分并没有真正按照我想要的方式工作。
有人能指出正确的方向吗?
谢谢
【问题讨论】:
-
您希望您的结果出现在像引号一样的列表中吗?还是没有?
-
你可以同时显示。我认为
'"[^"]*"'显示带引号的结果,"(.*?)"显示不带引号的结果。 -
你想先在
$上拆分然后找到引用的吗? -
引号之间可能有多个句子,引号外带有(有时不带有)
$符号。 -
如果我的回答对您有用,请考虑接受。