【发布时间】:2018-12-29 05:17:27
【问题描述】:
我正在尝试从 URL 中提取标题,但它没有类。以下代码取自页面源代码。
<a href="/f/oDhilr3O">Unatama Don</a>
标题实际上确实有一个类,但您可以看到我使用了索引 3,因为前 3 个标题不是我想要的。但是,我不想使用硬编码。但在网站中,标题也是一个链接,因此,上面的链接。
title_name=soup.find_all('div',class_='food-description-title')
title_list=[]
for i in range (3,len(title_name)):
title=title_name[i].text
title_list.append(title)
"Unatama Don" 是我想要获得的标题。
【问题讨论】:
-
请填写minimal reproducible example。检查How to Ask 链接也是个好主意
-
<a>是超链接而不是div类,您的代码正在获取 div 元素而不是您期望的 元素 -
使用硒? stackoverflow.com/questions/33155454/…driver.find_element_by_xpath('//a[@href="/f/oDhilr3O"]');
标签: python web-scraping beautifulsoup