【发布时间】:2017-01-18 14:57:41
【问题描述】:
我正在尝试为我的锚标签上的所有 href 创建一个唯一列表
from urllib2 import urlopen
from bs4 import BeautifulSoup
import pprint
url = 'http://barrowslandscaping.com/'
soup = BeautifulSoup(urlopen(url), "html.parser")
print soup
tag = soup.find_all('a', {"href": True})
set(tag)
for tags in tag:
print tags.get('href')
结果:
http://barrowslandscaping.com/
http://barrowslandscaping.com/services/
http://barrowslandscaping.com/design-consultation/
http://barrowslandscaping.com/hydroseeding-sodding/
http://barrowslandscaping.com/landscape-installation/
http://barrowslandscaping.com/full-service-maintenance/
http://barrowslandscaping.com/portfolio/
http://barrowslandscaping.com/about-us/
http://barrowslandscaping.com/contact/
http://barrowslandscaping.com/design-consultation/
http://barrowslandscaping.com/full-service-maintenance/
我尝试将 set(tag) 移到 for 循环中,但这并没有改变我的结果。
【问题讨论】:
标签: python beautifulsoup unique href