【问题标题】:Getting the likes and comments of a photo from Facebook using Selenium使用 Selenium 从 Facebook 获取照片的点赞和评论
【发布时间】:2021-06-05 18:13:19
【问题描述】:

我期待得到标题所描述的内容。我已经找到了登录并获取我搜索的任何个人资料照片的方法。 但是,当涉及到我选择的任何照片的 cmets 或喜欢时,我无法获得它们。 我的意思是 Chromedriver 点击照片以显示它,我想在显示照片时只获得喜欢的数量(只是蓝色的)和张贴在该照片上的 cmets(右面板)。 我没有找到任何有用的教程或帖子(实际上我已经搜索了很多)。

这是我寻找照片的方式,以防您需要查看一些代码:

time.sleep(4)
imagenes = []
for i in ['photos_of','photos_all']:
    driver.get("https:/www.facebook.com/userBasedOnURL/" + i + "/")
    time.sleep(3)
    n_scrolls = 3
    for j in range(1, n_scrolls):
        driver.execute_script("window.scrollTo(0, document.body.scrollHeight);")
        time.sleep(3)
        anchors = driver.find_elements_by_tag_name('a')
        anchors = [a.get_attribute('href') for a in anchors]
        anchors = [a for a in anchors if str(a).startswith("https://www.facebook.com/photo")]
        #print(anchors)
        for a in anchors:
            driver.get(a)
            time.sleep(3)
            imagen = driver.find_elements_by_tag_name("img")
            #print(imagen)
            imagenes.append(imagen[0].get_attribute("src"))
imagenes

在此先感谢并原谅我的英语。

【问题讨论】:

  • 您到底在问什么?喜欢或 cmets 或朋友列表?或以上所有?在用户个人资料中还是在帖子中?在用户的墙上发帖还是在群里发帖?所有这些都是不同的情况和条件......
  • 另外,请询问一些具体的问题,而不是我列出的所有内容,因为这里的每个问题都必须针对一个具体问题
  • 已更改为更具体的上下文。谢谢!
  • 好吧,还是不够清楚。你问的是点赞数还是各种点赞的详细数?照片是在用户摔倒时还是在单击照片后显示在照片查看器视图中?
  • 好吧,我想现在更具体了。干杯伙伴!

标签: python selenium facebook css-selectors screen-scraping


【解决方案1】:

在照片查看器视图中定位照片下的喜欢数量的 XPath 是

//div[@aria-label="Photo Viewer"]//span[@class='pcp91wgn']

或在 CSS 选择器语法中:

div[aria-label="Photo Viewer"] span[class="pcp91wgn"]

可以使用这个 CSS 选择器定位那里的 cmets

div[aria-label="Photo Viewer"] div[class="ecm0bbzt e5nlhep0 a8c37x1j"]

或使用 XPath 语法:

//div[@aria-label="Photo Viewer"]//div[@class="ecm0bbzt e5nlhep0 a8c37x1j"]

所以你可以像这样迭代链接列表:

from selenium.webdriver.common.by import By
from selenium.webdriver.support.ui import WebDriverWait
from selenium.webdriver.support import expected_conditions as EC

photoview_comment_xpath = '//div[@aria-label="Photo Viewer"]//div[@class="ecm0bbzt e5nlhep0 a8c37x1j"]'
photoview_likes_amount_css = 'div[aria-label="Photo Viewer"] span[class="pcp91wgn"]'

likes = []
comments = []
for link in links:
    driver.get(link)
    like = wait.until(EC.visibility_of_element_located((By.CSS_SELECTOR, photoview_likes_amount_css))).text.strip()
    like.append(like)
    comments_elements = driver.find_elements_by_xpath(photoview_comment_xpath)
    for comment in comments_elements:
        comments.append(comment.text.strip())

我认为您不会找到有关每个特定网站的教程。在这里你要学习的是如何为 web 元素找到稳定的唯一定位器,以及 XPath 和 css 选择器语法

【讨论】:

  • 请注意字符串 pcp91wgn、ecm0bbzt、e5nlhep0 和 a8c37x1j 可能随时更改
  • 我知道。我在几个帖子中验证了这一点,发现所有事件都是一样的。
  • 非常感谢!
猜你喜欢
  • 1970-01-01
  • 1970-01-01
  • 2012-03-01
  • 2011-11-30
  • 1970-01-01
  • 1970-01-01
  • 2014-01-30
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多