【问题标题】:Get only all the visible text from a url [closed]仅从 url 获取所有可见文本 [关闭]
【发布时间】:2018-01-12 12:02:22
【问题描述】:

我想从一个 url 中获取所有可见的文本。我需要清除所有 html 代码并获取纯文本。

过程不必完美,但我希望文本尽可能干净。

你知道有什么方法可以让它变得相对简单吗?

谢谢! 哈维。

【问题讨论】:

  • 你在这里要求什么?请编辑并明确您的答案,并举例说明您想要明确您的问题。
  • @Martin 请编辑并明确您的答案并展示答案的示例? ;-)
  • @Andreas 我不在审核系统中我在 PHP 标记中偶然发现它,这不是一个答案,而是一个问题:P
  • 我不明白你想要什么。我认为这个问题很清楚。事实上,我得到了第一个的有效答案。

标签: php html web-scraping plaintext


【解决方案1】:

看看strip_tags函数。

strip_tags — Strip HTML and PHP tags from a string

它可以完成这项工作。

【讨论】:

  • 哦,谢谢。这是完美的。我是自学成才,不知道php的所有功能...strip_tags会做动作。
【解决方案2】:

您可以使用$_GET['the names in there'] 获取网址。

如果您想获得所有信息,只需重构您所知道的 $_GET['name used in the url'] 即可。

function get_url(){ return $_GET['name userd'];}

并使用类似的东西

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 2011-12-18
    • 2013-07-19
    • 1970-01-01
    • 2012-08-07
    • 2018-07-30
    • 2021-01-27
    • 1970-01-01
    相关资源
    最近更新 更多