【问题标题】:Web crawler: web content does not show up in html code网络爬虫:网页内容不显示在 html 代码中
【发布时间】:2017-05-04 01:00:23
【问题描述】:

我正在为这个网页做一个基本的网络爬虫工作(只是为了学习目的,我已经得到了他们的许可):

http://www.seattle.gov/council/calendar#/?i=0

我想做的是以这种形式获取所有事件的“时间”、“描述”和“位置”。我已经尝试过 python 正则表达式,但是看起来这些信息没有显示在此页面的 HTML 代码中。相反,我使用的是 Selenium,但我仍然不知道在哪里可以找到这些信息。

【问题讨论】:

标签: python-2.7 selenium web-scraping web-crawler


【解决方案1】:

有时,事物就在你面前,但你看不到它们。

您可以从他们的 RSS Feed 中获取/提取该数据。在这里:http://www.trumba.com/calendars/seattle-city-council.rss

希望这会有所帮助。

【讨论】:

  • 我从没想过这个选项!太感谢了!我花了整个下午的时间......
  • 我很高兴@Emile
猜你喜欢
  • 1970-01-01
  • 1970-01-01
  • 2018-01-26
  • 1970-01-01
  • 1970-01-01
  • 2012-07-14
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多