【发布时间】:2016-02-23 03:08:44
【问题描述】:
遍历一系列 URL 直到没有更多结果返回的最简单方法是什么?
如果 URL 的数量是固定的,例如 9,类似下面的代码就可以了
for i in range(1,10):
print('http://www.trademe.co.nz/browse/categorylistings.aspx?v=list&rptpath=4-380-50-7145-&mcatpath=sports%2fcycling%2fmountain-bikes%2ffull-suspension&page='+ str(i)+'&sort_order=default ')
但是,URL 的数量是动态的,我看到一个页面显示“抱歉,目前此类别中没有列表。”当我过冲。下面的例子。
只返回带有结果的页面的最简单方法是什么?
干杯 史蒂夫
【问题讨论】:
-
if err in response: break怎么样,err是您上面提到的错误?不过,使用 trademe API 很可能会更干净 -
我建议像一个优秀的互联网公民一样使用他们的 API,而不是窃取他们的数据:developer.trademe.co.nz/api-terms/terms-and-conditions
标签: python loops url web-scraping