【问题标题】:Web scraping into list网页抓取到列表
【发布时间】:2020-03-17 22:59:40
【问题描述】:

我正在尝试使用 BeautifulSoup 将以下标签添加到应如下所示的列表中。 [Computer Science 1026A/B,Computer Science 2120A/B,Engineering Science 1036A/B, Digital Humatities 2220A/B]

我已经尝试了我能想到的一切。问题是这个<div> 类似乎没有名字

<div><strong>Antirequisite(s):</strong> <a
        href="Courses.cfm?CourseAcadCalendarID=MAIN_006440_1&amp;SelectedCalendar=Live&amp;ArchiveID=">Computer Science
    1026A/B,</a> <a href="Courses.cfm?CourseAcadCalendarID=MAIN_023958_1&amp;SelectedCalendar=Live&amp;ArchiveID=">Computer
    Science 2120A/B,</a> <a
        href="Courses.cfm?CourseAcadCalendarID=MAIN_019426_1&amp;SelectedCalendar=Live&amp;ArchiveID=">Engineering
    Science 1036A/B,</a> Digital Humatities 2220A/B.
</div>

【问题讨论】:

标签: python html python-3.x python-2.7 beautifulsoup


【解决方案1】:

您可以使用://strong[contains(text(),"Antirequisite")]/following-sibling::a/text() 循环遍历所有包含“Antirequisite”文本的元素并获取文本。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2020-06-18
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2020-05-10
    相关资源
    最近更新 更多