【问题标题】:Scraping data with bs4使用 bs4 抓取数据
【发布时间】:2022-01-17 19:48:25
【问题描述】:

我有这行html:

<td title="Druid"><a href="/pvp/druid"><img src="/images/classes/druid.png" class="img-responsive center" alt="Druid"></a></td>

用蟒蛇和美汤, 我想从&lt;td title="Druid"&gt; 访问“德鲁伊”以存储为变量。

【问题讨论】:

  • 嗨!我们通常要求人们在 Stack Overflow 上发布他们第一次尝试解决他们的问题 - 如果您可以添加这些内容,那将非常有帮助:)

标签: python beautifulsoup


【解决方案1】:

如果要访问 td 的标题:

bs4.BeautifulSoup(data).find("td")["title"]

【讨论】:

    【解决方案2】:

    要获取标签的属性,请将其视为字典:

    soup.find('td').get('title')
    

    soup.find('td')['title']
    

    注意:.get('title', 'some default value') 允许您在缺少键或省略时提供默认值None,而['title'] 将引发 KeyError

    示例

    from bs4 import BeautifulSoup
    html='''<td title="Druid"><a href="/pvp/druid"><img src="/images/classes/druid.png" class="img-responsive center" alt="Druid"></a></td>'''
    soup = BeautifulSoup(html)
    
    character = soup.find('td').get('title')
    
    print(character)
    

    输出

    Druid
    

    【讨论】:

    • 当然,如果问题中有更多信息 - 但是,对于给定的示例,我认为它必须是足够的和适应的。重点是访问属性title。
    猜你喜欢
    • 2018-09-13
    • 1970-01-01
    • 2020-10-10
    • 1970-01-01
    • 1970-01-01
    • 2017-03-21
    • 2013-12-04
    • 1970-01-01
    • 2019-03-08
    相关资源
    最近更新 更多