【发布时间】:2014-06-13 07:57:33
【问题描述】:
我正在使用 python scrapy 来抓取一个网站。 网页格式为http://www.cuponation.in/myntra-coupons#voucher-13537 它包含'#'。在将此网页抓取为 start_url 时,它会忽略 # 之后的部分。
有没有办法我可以使用 python scrapy 刮掉带有 # 的完整网址
【问题讨论】:
-
#只会将您带到页面上的特定位置。
标签: python web-scraping scrapy fragment-identifier