【问题标题】:Python- Scrape LinkedIn NamesPython- 抓取 LinkedIn 名称
【发布时间】:2021-02-28 23:29:54
【问题描述】:

我的代码将通过输入登录名和密码信息到达所需的网页。

(您可以在下面的代码中尝试任何拥有 LinkedIn 帐户的用户名和密码)

现在我已经到了所需的页面,我只需要知道如何抓取信息。

如果我可以从每个列表的名称开始,那就太好了。

import time

from selenium import webdriver
from selenium.webdriver.chrome.options import Options
from webdriver_manager.chrome import ChromeDriverManager
productlinks=[]
test1=[]

options = Options()

driver = webdriver.Chrome(ChromeDriverManager().install())


url = "https://www.linkedin.com/uas/login?session_redirect=https%3A%2F%2Fwww%2Elinkedin%2Ecom%2Fsearch%2Fresults%2Fpeople%2F%3FcurrentCompany%3D%255B%25221252860%2522%255D%26geoUrn%3D%255B%2522103644278%2522%255D%26keywords%3Dsales%26origin%3DFACETED_SEARCH%26page%3D2&fromSignIn=true&trk=cold_join_sign_in"
driver.get(url)
time.sleep(2)

username = driver.find_element_by_id('username')
username.send_keys('Example@gmail.com')
password = driver.find_element_by_id('password')

password.send_keys('ExamplePassword')
password.submit()

【问题讨论】:

    标签: python html selenium


    【解决方案1】:

    您可以使用他们的类名find_elements_by_class_name

    抓取html元素

    请看下面的例子:

    import time
    from selenium import webdriver
    
    options = webdriver.ChromeOptions()
    options.add_argument('--disable-gpu')
    options.add_argument('--ignore-certificate-errors-spki-list')
    options.add_argument('--ignore-ssl-errors')
    
    driver = webdriver.Chrome(chrome_options=options)
    
    driver.get("https://www.linkedin.com/login")
    
    username = driver.find_element_by_id('username')
    username.send_keys('User_example')
    password = driver.find_element_by_id('password')
    password.send_keys('Password_example')
    password.submit()
    
    time.sleep(1)
    
    MyProfileName=driver.find_elements_by_class_name("profile-rail-card__actor-link")
    print("MyProfileName is: " + MyProfileName[0].text.strip())
    
    print("\n List of Names: \n");
    
    #Redirect to another link
    driver.get("https://www.linkedin.com/onboarding/start/people-you-may-know/new/")
    
    time.sleep(2)
    
    Names = driver.find_elements_by_class_name("onboarding-card__person-title")
    for name in Names:
        print(name.text.strip())
    

    【讨论】:

      猜你喜欢
      • 2021-02-26
      • 1970-01-01
      • 1970-01-01
      • 2021-12-18
      • 1970-01-01
      • 2018-12-17
      • 1970-01-01
      • 1970-01-01
      • 2020-01-23
      相关资源
      最近更新 更多