【发布时间】:2019-05-15 16:29:27
【问题描述】:
我需要此代码中的标题、地址、电话号码和描述。到目前为止,我已经做到了。现在我被卡住了,请帮助新的网络抓取
from IPython.core.display import display, HTML
display(HTML("<style>.container { width:100% !important; }</style>"))
from bs4 import BeautifulSoup as soup
import urllib.request
import pandas as pd
withurllib.request.urlopen("http://buildingcongress.org/list/category/architects-6") as url:
s = url.read()
page_soup = soup(s, 'html.parser')
listings = []
for rows in page_soup.find_all("div"):
if ("mn-list-item-odd" in rows["mn-listing mn-nonsponsor mn-search-result-priority-highlight-30"]) or ("mn-list-item-even" in rows["mn-listing mn-nonsponsor mn-search-result-priority-highlight-30"]):
name = rows.find("div", class_="mn-title").a.get_text()
我的 for 循环出现错误。我卡住了,请帮忙
【问题讨论】:
-
请提供错误。
-
您需要从每个企业的登录页面收集初始链接,然后访问每个页面以获取所有信息
-
欢迎,为了改善您在 SO 上的体验,请阅读 How to Ask 和 How to create a Minimal, Complete and Verifiable Example。我还建议你take the tour。
-
OP - 请不要故意破坏答案和问题。
标签: python html web-scraping beautifulsoup