【发布时间】:2017-05-23 20:23:13
【问题描述】:
我正在尝试从整个 HTML 源代码中提取特定的字符串。
HTML来源:view-source:https://www.instagram.com/p/BUbZXXMjnxY/?taken-by=narentrigger&hl=en
需要提取字符串:https://instagram.fmaa1-2.fna.fbcdn.net/t51.2885-15/e35/18645014_163619900839441_7821159798480568320_n.jpg
来自“og:image”元属性。
我尝试了一些方法,但一切都出错了。有没有办法从源代码的 og:image 元属性中获取图像链接。提取后需要将图像 url 存储在特定变量上。需要专家帮助。 Url that need to extract
【问题讨论】:
-
你可以使用 PHP DomDocument 来构建一个爬虫。 php.net/manual/en/class.domdocument.php
-
你为什么不分享那些“一些方法”以及“一切都出错”是什么意思,即你得到了什么具体的错误?
-
所以要提取
og:image元的content属性? -
是的,我需要从整个源代码@BenM 中提取 og:image meta 的 content 属性
-
@Narendhiranvignesh 请看我的回答。
标签: php html string url substring