【发布时间】:2016-10-20 09:57:54
【问题描述】:
我无法从网页上抓取游戏名称.. 它返回一个空白数组..一旦名称被刮掉,我希望它被写入一个新创建的文本文件..我的代码应该在下面..它远未完成,但我确定我需要一个 While 条件..
def ScrapeK10():
siteToScrape = 'http://www.kiz10.com/new-games'
print '\n[!] Requesting Kiz10..'
kizReq = requests.get(siteToScrape)
print '\n[!] Scraping Newest Games...'
kizTree - html.fromstring(kizReq.content)
kizElement = kizTree.xpath('//strong[@class="bx-caption"]/text()')
print 'Latest Games : ', kizElement, '\n'
return
我遇到的问题是我得到一个空白数组,所以我不确定我是否真的正确地抓取了网站,甚至使用了正确的 xpath?
对此还有点新意..不想使用 Beautiful Soup 也不想使用 Scapy..
但我的目标是抓取我提供的网页中的所有游戏名称,并将它们写入一个新文件..
【问题讨论】:
-
请包含您正在使用的任何模块。
标签: python web python-requests screen-scraping analysis