【发布时间】:2019-09-01 13:44:16
【问题描述】:
from bs4 import BeautifulSoup as Soup,Tag
import requests
url=r"https://en.wikipedia.org/wiki/Lists_of_tourist_attractions"
r = requests.get(url)
soup = Soup(r.content,"html.parser" )
for link in soup.find_all('a', href=True):
print (link['href'])
for ul in soup.findAll('div'):
print(ul.text)
for li in ul.findAll('li'):
print(li.text)
上面是一个工作代码。这可以使用任何维基百科页面。 问题是: 我想得到 href 和标题彼此相邻。我无法得到这个。
在第二个 for 循环中,它将所有内容作为 div 并打印在一行中。
如何打印标题和 href 互相辅助(li 内容)
【问题讨论】:
-
您能更具体地说明您想要什么吗?
how can I print title and href adjutant to each other (li contents)这句话我看不懂 -
您是否只想将寺庙列表打印出来,旁边有它们的网址?
-
wiki中的
- 有很多内容。它有标题和href。我正在考虑打印它们。
-
现在用我的程序我可以打印所有的href,所有的标题,但不能同时调整
-
是的,因为您将它们放在单独的循环中。你使用的逻辑太简单了。如果我是你,我至少会使用数组,并在抓取完成后打印数组。或者创建一个 txt 文件或其他东西并保持它的整洁
标签: python beautifulsoup