【发布时间】:2015-01-15 11:19:20
【问题描述】:
我写了这个脚本:
def extractURL(data):
links = re.findall(r'href=[\'"]?([^\'" >]+)', data)
scrlinks = re.findall(r'scr=[\'"]?([^\'" >]+)', data)
print '+' + str(len(links))
logfile = open('links.dat', 'a')
for link in links:
logfile.write('%s\n' % (link))
for link in scrlinks:
logfile.write('%s\n' % (link))
logfile.close()
是否可以在同一个列表中多次提取正则表达式?一次性使用。
【问题讨论】:
-
你能举个例子解释一下吗?
-
得不到你想要的?功能看起来不错..你能详细解释一下吗??
-
表示你只需要一个变量来存储 re?? 的结果?
-
html = curl.getHTML("soldiweb.net/") html1 = curl.getHTML("mondocompatibile.it/") 链接 = re.findall(r'href=[\'"]?([^\ '" >]+)', html) links += re.findall(r'scr=[\'"]?([^\'" >]+)', html1) 链接中的链接:打印链接跨度>
-
是的,我想将结果存储在一个变量中