【发布时间】:2014-02-27 15:37:39
【问题描述】:
我编写了这段代码来打印一张表格,如http://www.medindia.net/drug-price/list.asp 所示
import mechanize
import urllib2
from bs4 import BeautifulSoup
med="paracetamol"
br=mechanize.Browser()
br.set_handle_robots(False)
res=br.open("http://www.medindia.net/drug-price/")
br.select_form("frmdruginfo_search")
br.form['druginfosearch']=med
br.submit()
url=br.response().geturl()
print url
web_page = urllib2.urlopen(url)
soup = BeautifulSoup(web_page)
tabl=soup.find_all('table')
rows=tabl.find_all('tr')
for tr in rows:
cols=tr.find_all('td')
for td in cols:
text = ''.join(td.find(text=True))
print text+"|",
但是当我执行同样的操作时,我得到了这个错误
rows=tabl.find_all('tr')
AttributeError: 'list' object has no attribute 'find_all'
谁能帮我解决这个问题?谢谢!
【问题讨论】:
标签: python html parsing html-parsing beautifulsoup