【发布时间】:2012-10-17 20:00:02
【问题描述】:
有许多产品提供了一个 gui 来挑选你想从网页中抓取的标签。 (例如 WebHarvy 之类的东西)
我以前看过 HTML Agility Pack 以获取 DOM。 我只是想检查一下是否有人知道任何不错的库或流程,用于在 HTML 页面中自动查找有用的内容并创建所需的 XPath。
类似于 Evernote 和 iOS 如何知道“文章”在页面上的位置。然而,理想情况下适用于重复区域和分页。
【问题讨论】:
标签: c# html web-scraping