【问题标题】:Parsing HTML file for a particular value [duplicate]解析特定值的 HTML 文件 [重复]
【发布时间】:2013-05-29 13:01:15
【问题描述】:

我有许多 HTML 文件,我想从所有这些文件中提取一个特定的值。

<div class="ABC">Value</div>

我想从所有页面中提取Value。我应该使用正则表达式还是一些 HTML 解析库? 我对正则表达式不是很熟悉,也找不到任何关于 HTML 库的文档 - HTML Agility。

我应该采用哪种方法?如果我应该使用正则表达式或库,或者有更好的方法吗?

【问题讨论】:

标签: c# regex html-parsing


【解决方案1】:

最推荐的方式是自己解析。

您将需要创建一个方法,但在未来您将拥有它作为您自己的工具,随着每个问题不断发展。

看看:

How to get IMG tag's source from given HTML string using c#

【讨论】:

  • 这实际上正是您不想想要做的事情。
  • 为什么?托马斯,你能解释一下吗?您发布了,我链接到的内容。敖有什么不同?
  • 为这个任务滚动你自己的 XML 解析器是荒谬的,而且在大多数情况下对于任何事情都是如此。
  • A ) 他在谈论 HTML。 B)您所有的关键字都是相同的东西,我也链接了。
  • HTML is XML(尽管它是丑陋的孩子),我链接的关键字将允许您解析某人 非常具体 作为对这个实例的讽刺而不是一时兴起用于此类任务的东西。
猜你喜欢
  • 2018-07-12
  • 2011-12-16
  • 1970-01-01
  • 2019-06-07
  • 2017-12-29
  • 2021-09-24
  • 1970-01-01
  • 2014-10-03
  • 2014-02-05
相关资源
最近更新 更多