【发布时间】:2018-05-10 18:36:03
【问题描述】:
我需要废弃一个网站以获取一些信息,例如电影的标题和相关链接。我的代码运行正确,但它停在网站的第一行。这是我的代码,提前感谢您的帮助,如果这不是一个聪明的问题,我很抱歉,但我是新手。
import requests
from bs4 import BeautifulSoup
URL= 'http://www.simplyscripts.com/genre/horror-scripts.html'
def scarica_pagina(URL):
page = requests.get(URL)
html = page.text
soup = BeautifulSoup(html, 'lxml') l
films = soup.find_all("div",{"id": "movie_wide"})
for film in films:
link = film.find('p').find("a").attrs['href']
title = film.find('p').find("a").text.strip('>')
print (link)
print(title)
【问题讨论】:
-
告诉网站网址
-
这里的一切看起来都很好。听起来你有一个依赖于网站的问题。
-
您可以将链接发布到该网站并通过编辑您的问题来完成
-
我做到了,谢谢!
-
只有一个
div#movie_wide和多个ps 包含as。
标签: python web-scraping beautifulsoup screen-scraping