【发布时间】:2012-03-17 05:56:09
【问题描述】:
我想使用 python 和 lxml 从下面的网站中提取部分症状的测试部分。谁能帮忙。
http://www.ncbi.nlm.nih.gov/pubmedhealth/PMH0001851/
谢谢,
【问题讨论】:
-
是否需要与 lxml 一起使用?
标签: python html web-scraping lxml webpage
我想使用 python 和 lxml 从下面的网站中提取部分症状的测试部分。谁能帮忙。
http://www.ncbi.nlm.nih.gov/pubmedhealth/PMH0001851/
谢谢,
【问题讨论】:
标签: python html web-scraping lxml webpage
你想用 lxml 抓取网页吗?试试这个:
from lxml.html import parse
doc = parse("http://www.ncbi.nlm.nih.gov/pubmedhealth/PMH0001851/").getroot()
for h2 in doc.cssselect('h2'):
print h2.text_content()
这将打开从您的页面抓取 h2s。
【讨论】: