【发布时间】:2013-07-24 11:10:07
【问题描述】:
我有一个包含一些链接的 pdf。链接不会像 http://www.example.com/abcd.pdf。但是有一些文本链接到一些 url。我只想提取那个网址。
【问题讨论】:
-
您是否能够从 PDF 文件中获取文本?如果没有,请查看:stackoverflow.com/questions/1882318/…。之后,您可以使用 REGEX(例如)在文本中搜索 URL。
-
我尝试过使用其他 pdf 阅读器。我正在获取文本,但与文本关联的链接(url)没有获取。
-
你想获取什么链接?
preg_match_all还是什么?发布您的代码.. -
@peter,我无法在此处发布所有代码。代码太长。我正在使用此代码。 webcheatsheet.com/php/reading_clean_text_from_pdf.php
-
我是指从 PDF 中提取文本后的代码。