【发布时间】:2012-03-25 18:54:53
【问题描述】:
好吧,我已经编写了一个简单的 python 程序,它使用 HTMLParser 解析 HTML。这是我的代码
import re
import os.path
import getopt
import getpass
import atom
import getopt
import sys
import string
import cookielib
import ClientCookie
import urllib
import urllib2
from HTMLParser import HTMLParser
from htmlentitydefs import name2codepoint
url = 'http://distribucija.altpro.hr/cjenik_include.php'
all_data = []
def ReParse(pin):
global values
values = {'kaj' : 'sifra',
'rijec' : pin,
'prikaz' : '20' }
data = urllib.urlencode(values)
req = urllib2.Request(url, data)
response = urllib2.urlopen(req)
global the_page
the_page = response.read()
class MyHTMLParser(HTMLParser):
def handle_data(self, data):
all_data.append(data)
parser = MyHTMLParser()
ReParse('3884429')
parser.feed(the_page)
print all_data[74]
ReParse('1241236')
parser.feed(the_page)
print all_data[74]
现在,第一个 parser.feed(.... 有效并且 all_data[74] 是正确的,但是第二个提要给出的内容与第一个提要完全相同,但它不应该。任何人都可以帮助我吗?
【问题讨论】:
标签: python html parsing html-parsing