【发布时间】:2015-10-18 03:33:55
【问题描述】:
我正在(慢慢地)学习使用 JSoup 来解析网站的源代码,但我觉得自己快要走到尽头了。也就是说,我不完全确定我应该研究什么方法。
理论上,我想开发一个筛选特定搜索页面(即 Google、Monster、Craigslist、eBay 等)并提取某些数据的应用程序。这些数据可能在第一页上,但它可能在列表的下方 10 多页(在 Google 中,显然它可能是数百页)。无论是搜索结果 (Google)、职位发布 (Monster) 还是待售商品 (Craigslist/eBay),我该如何完成这项工作?
直到最近我才知道 JSoup。而且我不会“坚持”使用它。但是,我的研究让我相信使用 JSoup 会给我带来想要的结果。所以,我正在尝试学习如何使用它来做我想做的事。 (如果有人知道任何广泛的初学者教程,请告诉我)
那么我应该怎么做呢?我知道这是一个模糊的问题,但我有一个目标,但我不确定我是如何实现的。
我还考虑过在可用时使用/搜索 RSS 提要(即 Craigslist)。这是否也可能比直接从站点/源代码中提取更容易或更难?
除此之外,我希望能够在出现新信息时向用户发送通知(Craigslist/eBay 上出售的新商品、Monster 上的新工作等)。我可以确定我确定。
提前致谢!
【问题讨论】:
标签: java android parsing rss jsoup