【发布时间】:2018-02-23 18:51:36
【问题描述】:
我使用python 3.6,我尝试从页面中提取数据,但我想同时从多个页面中提取数据,代码如下:
page = requests.get('http://www.poetsgate.com/ViewPoem.aspx?id=12343')
tree = html.fromstring(page.content)
text1 = tree.xpath('//div[@class="col1 first"]/text()')
text2 = tree.xpath('//div[@class="col2 second"]/text()')
有什么方法可以提取数据,但我不喜欢使用页面的所有 URL 列表!
【问题讨论】:
-
没有 URL 列表?您可以执行递归
wget。除非您有权访问该网站的数据库,否则我不知道您将如何确定使用哪个?id=s。
标签: python extract extraction text-extraction data-extraction