【发布时间】:2014-03-16 18:15:08
【问题描述】:
如果您访问http://www.imdb.com/title/tt2375692/episodes?season=1 在这里,你会看到第 1 季第 1 集的发布日期是 2014 年 1 月 25 日,
这是我用来抓取的代码。
req = urllib2.Request('http://www.imdb.com/title/tt2375692/episodes?season=1')
self.diziPage = urllib2.urlopen(req).read()
self.diziSoup = BeautifulSoup(self.diziPage,from_encoding="utf8")
在我抓取网站后,一切都很好,除了播出日期, 第 1 集的播出日期是 2014 年 4 月 20 日,我去的时候还没有,其余的信息都是正确的。
我认为这可能是因为我做了一些实验但没有奏效。
【问题讨论】:
-
当我在浏览器中访问该页面时为我显示
20 April 2014...
标签: python html beautifulsoup html-parsing