【发布时间】:2015-12-21 15:16:16
【问题描述】:
我想知道如何使用 BeautifulSoup 在我的列表中打开另一个页面?我关注了this tutorial,但它并没有告诉我们如何打开列表中的另一个页面。另外,如何打开嵌套在类中的“a href”?
这是我的代码:
# coding: utf-8
import requests
from bs4 import BeautifulSoup
r = requests.get("")
soup = BeautifulSoup(r.content)
soup.find_all("a")
for link in soup.find_all("a"):
print link.get("href")
for link in soup.find_all("a"):
print link.text
for link in soup.find_all("a"):
print link.text, link.get("href")
g_data = soup.find_all("div", {"class":"listing__left-column"})
for item in g_data:
print item.contents
for item in g_data:
print item.contents[0].text
print link.get('href')
for item in g_data:
print item.contents[0]
我正在尝试从每个企业的标题中收集 href,然后打开它们并抓取该数据。
【问题讨论】:
-
首先,我不明白你在问什么。那么,也许你想看看the document。
-
您需要让我们知道您希望抓取哪个页面。需要
r = requests.get("http://www.yellowpages.com/")之类的东西。 -
我应该多解释一下,我想做的是在一个 div ect 中打开一个 href。 puu.sh/kmgxZ/15fc324654.png我想调用每个有链接的href并打开它们的页面然后开始报废
标签: python python-2.7 web-scraping beautifulsoup