【发布时间】:2014-11-13 16:19:31
【问题描述】:
我正在尝试从 NIST 网站访问一个表: http://physics.nist.gov/PhysRefData/XrayMassCoef/tab3.html
假设我点击了元素锌。我想使用 python 2.7 将 Energy、u/p 和 u[en]/p 的信息检索到表的 3 列中。
我开始学习 BeautifulSoup 和 Mechanize。但是,我发现很难在与此站点上的表格相关的 HTML 代码中识别出清晰的模式。
我正在寻找类似这样的方式:
import mechanize
from bs4 import BeautifulSoup
page=mech.open("http://physics.nist.gov/PhysRefData/XrayMassCoef/tab3.html")
html = page.read()
soup = BeautifulSoup(html)
我的想法是尝试:
table = soup.find("table",...)
上面的 ... 将是一些标识符。我在上面的 NIST 网站上找不到明确的标识符。
如何使用 python 2.7 导入此表?
编辑:是否可以将这 3 列放在一个表中?
【问题讨论】:
标签: python beautifulsoup urllib2 mechanize urllib