【问题标题】:How to get link HTML in C#? [duplicate]如何在 C# 中获取链接 HTML? [复制]
【发布时间】:2014-10-25 11:55:30
【问题描述】:

我有以下代码:

<div id="list">
  <table>
    <tr>
      <th>STT</th>
      <th>Link</th>
    </tr>

    <tr>
      <td>Line 1</td>
      <td><a href="http://website.com/link1">Link 1</a></td>
    </tr>

    <tr>
      <td>Line 2</td>
      <td><a href="http://website.com/link2">Link 2</a></td>
    </tr>
  </table>
</div>

如何获得:

http://website.com/link1

http://website.com/link2

【问题讨论】:

标签: c# html-agility-pack


【解决方案1】:

Xpath 以您给出的确切结构获取表中 a 元素的 hrefs:

htmlDoc.DocumentNode.SelectNodes("//div[@id='list']/table/tr[td]/td[a]/a");

然后刮掉所有的@href 属性。

解压:

找到属性为 id 且值为 'list' 的 div,然后导航到子 table ,然后只是那些带有 td 子元素的 tr 行,然后,类似地,导航到 td 元素有一个a 孩子。

【讨论】:

  • 但是我们如何得到结果。 website.com/link1website.com/link2
  • 您需要重新掌握Xml (XmlDocument or Linq to Xml XDocument) 的技能——both here 的示例
  • 如何才能得到上面代码中的结果。
猜你喜欢
  • 2014-01-07
  • 2020-02-14
  • 1970-01-01
  • 1970-01-01
  • 2013-02-24
  • 1970-01-01
  • 1970-01-01
  • 2021-07-25
  • 2018-07-16
相关资源
最近更新 更多