【发布时间】:2010-06-13 04:00:37
【问题描述】:
我需要从 html 文档中提取特定的 ID,但问题是不能“使用”该 ID。
这里是html内容 http://pastebin.com/wF2dx8JZ
您可能会看到有不同的 html 块。其中一些包含“已使用”一词,因此我只需要提取第一个未使用的 id。 基本上我可以写一个简单的模式,如: $pattern = "/javascript:tw(.*))/"; preg_match_all($pattern, $content, $matches); $id = $matches[1][0];
但是在这种情况下,我也得到了使用的“ids”,所以我不知道如何将它们从等式中排除。任何想法将不胜感激。
【问题讨论】:
-
哇?第 1 步:给我们一个您实际想要返回的数据的示例。第 2 步:使用解析器,它会让您的生活更轻松。
-
如您所见,我需要提取 javascript:tw( 和 ) 之间的数据。一个例子可能是 272896、309206、308845 等......我遇到的问题是一些 html 块包含“使用”字......“Used”......我应该不要从包含“使用”字的块中提取信息。
标签: php regex preg-match