【发布时间】:2015-01-15 16:28:46
【问题描述】:
当我想从网页获取数据时,我通常将 HtmlAgilityPack 与 HtmlDocument 对象一起使用,该对象使用网站的主 web url,然后将 HtmlNode 对象与主表一起使用,例如我想要从页面中获取的所有数据和将它的 XPath 复制到输入中。示例:
HtmlDocument hDocument = GetHtmlDocumentFromUrl("http://someweb.com");
HtmlNode mainNode = hDocument.DocumentNode.SelectSingleNode("//*[@id='XpathOfTableWithData']");
这样做之后,我可以循环进入这个主节点的子节点并得到我想要的,但是有些网站包含“标签”,它们比旧类型的网站更像新风格,然后我就得到了主节点节点为空。 如果页面带有 cookie 并且有标签,我如何使用 c# 和 HtmlAgilityPack 获取这些信息?
谢谢!
【问题讨论】:
标签: c# html-parsing html-agility-pack