【发布时间】:2016-02-01 19:04:14
【问题描述】:
大家好,我需要你们的支持! 我有一些页面(here)并尝试将其废弃。在页面上有下拉菜单和下拉菜单中的选项更改页面上的信息(对于更改选项我使用硒)。我正在尝试迭代选择选项(我找到了示例 here)并在更新后从页面收集信息,但在输出文件中我有 4 个相同的值(好像选项没有改变)。 Selenium 正确迭代选项(我看到了),我不知道我做错了什么。 这是我的代码:
from colombo.items import ColomboItem
from scrapy.contrib.spiders import CrawlSpider
from selenium import webdriver
from scrapy.selector import Selector
from selenium.webdriver.support.ui import Select
import time
class ColomboSpider(CrawlSpider):
name = 'ColomboSpider'
allowed_domains = ["http://colombo.in.ua"]
start_urls = [
"http://colombo.in.ua/colombo-design/ruchka-colombo-gira-jm11.html",
]
def __init__(self):
CrawlSpider.__init__(self)
# use any browser you wish
self.browser = webdriver.Firefox()
def __del__(self):
self.browser.close()
def parse(self, response):
self.browser.get(response.url)
#let JavaScript Load
time.sleep(3)
optionsList = []# options attribute value
dropdown = self.browser.find_element_by_id("jshop_attr_id13")#my dropdown element name
options = dropdown.find_elements_by_tag_name('option')
for option in options: #iterate over the options, place attribute value in list
optionsList.append(option.get_attribute("value"))
hxs = Selector(response)
items = []
for optionValue in optionsList:
select = Select(self.browser.find_element_by_id("jshop_attr_id13"))#i found dropdown
select.select_by_value(optionValue)#and i click on n-value in my list
time.sleep(2)
firm_list = hxs.xpath('.//div[@class="jshop productfull"]/form[1]')
for sel in firm_list:
item = ColomboItem()
item['price']=sel.xpath('.//span[@id="block_price"]/text()').extract()
item['name']=sel.xpath('.//h1/text()').extract()
items.append(item)
return iter(items)
我在输出文件中的内容:
1929.61 грн Ручка Colombo GIRA JM11
1929.61 грн Ручка Colombo GIRA JM11
1929.61 грн Ручка Colombo GIRA JM11
1929.61 грн Ручка Colombo GIRA JM11
但是,正确的输出是
1929.61 грн Ручка Colombo GIRA JM11
2275.21 грн Ручка Colombo GIRA JM11
2456.66 грн Ручка Colombo GIRA JM11
2966.42 грн Ручка Colombo GIRA JM11
感谢您的回答)
【问题讨论】:
标签: python selenium drop-down-menu scrapy