【发布时间】:2014-08-10 10:52:40
【问题描述】:
我有一个网页: http://kff.org/womens-health-policy/state-indicator/ultrasound-requirements/# 我需要从这个网页中提取表格。
遇到的问题:我一直在使用 BeautifulSoup 并请求获取 url 内容。这些方法的问题在于,我什至能够在生成表格之前获取 Web 内容。
所以我得到了空桌子
我的方法:现在我正在尝试在浏览器中使用 webbrowser.open_new_tab(url) 然后直接从浏览器获取内容。这将使服务器更新表格,然后我将能够从页面获取内容。
问题:我不确定如何直接从 Web 浏览器获取信息。
现在我在 windows 系统上使用 Mozilla。
找到最近的链接website Link。但它给出了打开的网站而不是内容
还有其他方法可以让表格加载到 urllib2 或 beautifulsoup 和 requests 中吗?或者有什么方法可以直接从网页中获取加载的内容。
谢谢
【问题讨论】:
-
查看 Kenneth Reitz 的
requests库。
标签: python web-scraping python-webbrowser