【问题标题】:HtmlAgilityPack - parsing website with cookies/tabs using c#HtmlAgilityPack - 使用 c# 使用 cookie/选项卡解析网站
【发布时间】:2015-01-15 16:28:46
【问题描述】:

当我想从网页获取数据时,我通常将 HtmlAgilityPack 与 HtmlDocument 对象一起使用,该对象使用网站的主 web url,然后将 HtmlNode 对象与主表一起使用,例如我想要从页面中获取的所有数据和将它的 XPath 复制到输入中。示例:

HtmlDocument hDocument = GetHtmlDocumentFromUrl("http://someweb.com");
HtmlNode mainNode = hDocument.DocumentNode.SelectSingleNode("//*[@id='XpathOfTableWithData']");

这样做之后,我可以循环进入这个主节点的子节点并得到我想要的,但是有些网站包含“标签”,它们比旧类型的网站更像新风格,然后我就得到了主节点节点为空。 如果页面带有 cookie 并且有标签,我如何使用 c# 和 HtmlAgilityPack 获取这些信息?

谢谢!

【问题讨论】:

    标签: c# html-parsing html-agility-pack


    【解决方案1】:

    “标签”仍应是使用 CSS 增强的 html 元素。如果您查看有问题的网站之一,您应该会看到结构并相应地修改您的代码。

    【讨论】:

    • 但是怎么做呢?分配给 xPath 的 Html 节点始终为空,我尝试了许多不同的。
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2012-02-15
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多