【发布时间】:2019-07-19 02:19:45
【问题描述】:
我正在训练网络抓取。为此,我挑战自己,获得所有在 Instagram 上点赞帖子的人的名单。 我的问题是我被困在我只能得到喜欢的前 11 个用户名的地步。在获得喜欢的同时,我找不到正确的方法来自动化滚动过程。
这是我在 Jupyter Notebook 中的过程(它还不能用作脚本):
from selenium import webdriver
import pandas as pd
driver = webdriver.Chrome()
driver.get('https://www.instagram.com/p/BuE82VfHRa6/')
userid_element = driver.find_elements_by_xpath('//*[@id="react-root"]/section/main/div/div/article/div[2]/section[2]/div/div/a')[0].click()
elems = driver.find_elements_by_xpath("//*[@id]/div/a")
users = []
for elem in elems:
users.append(elem.get_attribute('title'))
print(users)
你们有什么想法吗?
非常感谢
【问题讨论】:
标签: python selenium web-crawler instagram