【问题标题】:Extracting a section from web page using python使用python从网页中提取部分
【发布时间】:2012-03-17 05:56:09
【问题描述】:

我想使用 python 和 lxml 从下面的网站中提取部分症状的测试部分。谁能帮忙。

http://www.ncbi.nlm.nih.gov/pubmedhealth/PMH0001851/

谢谢,

【问题讨论】:

  • 是否需要与 lxml 一起使用?

标签: python html web-scraping lxml webpage


【解决方案1】:

你想用 lxml 抓取网页吗?试试这个:

 from lxml.html import parse
 doc = parse("http://www.ncbi.nlm.nih.gov/pubmedhealth/PMH0001851/").getroot()
 for h2 in doc.cssselect('h2'):
     print h2.text_content()

这将打开从您的页面抓取 h2s。

【讨论】:

    猜你喜欢
    • 2012-07-13
    • 2021-12-05
    • 2017-12-04
    • 2019-04-12
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2015-10-06
    相关资源
    最近更新 更多