【问题标题】:Parse information from a website through python通过python从网站解析信息
【发布时间】:2015-09-13 21:01:45
【问题描述】:

我正在尝试将网站中的数字读入变量。编号所在的源代码如下所示:

<tr bgcolor="#ccffff"><td>N_300_0</td><td>5918.720</td></tr>

网站总是说 N_300_0,但数字会改变。

到目前为止,我有:

link = urllib2.urlopen("http://www.example.com").read()
matches = re.findall('N_300_0', link);
number = ....

如何将数字放入变量中?

【问题讨论】:

标签: python url


【解决方案1】:

如果您正在做任何严肃的或涉及到的抓取,我强烈同意BeautifulSoup 之类的东西是一个更好的方法。

但要回答您的问题,您需要在 python 正则表达式中通过括号使用grouping 来执行您想要的那种捕获,例如

numbers = re.findall('N_300_0</td><td>([-+]?\d*\.\d+|\d+)',s)

【讨论】:

    猜你喜欢
    • 2012-02-21
    • 2012-03-28
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2015-11-30
    • 1970-01-01
    • 2021-02-11
    相关资源
    最近更新 更多