【发布时间】:2017-11-12 13:08:33
【问题描述】:
我尝试使用 BeautifulSoup 和 requests 库来抓取 Twitter 数据。我尝试先使用 BeautifulSoup 登录,然后抓取所需的页面。但它不起作用。我没有弄错我所做的事情。
我正在添加此代码:
import requests
from bs4 import BeautifulSoup
session_rqst=requests.session()
url="https://twitter.com/login"
r=requests.get(url)
c=r.content
soup=BeautifulSoup(c,"html.parser")
token=soup.find("input",{"name":"authenticity_token"})
payload = {"username": "test_user", "password": "test_password"}
result=session_rqst.post(url, data=payload, headers =
dict(referer="https://twitter.com/"))
all=result.content
soup1=BeautifulSoup(all,"html.parser")
page=requests.get("https://twitter.com/akhiltaker/following")
page.content
soup1=BeautifulSoup(page.content,"html.parser")
如何从网页中抓取关注者列表?
【问题讨论】:
-
你应该使用developer.twitter.com。 Twitter 为此类活动提供了一个 API。
-
您需要立即更改您的推特密码。即使它已被编辑掉,任何有足够代表的人仍然可以看到它。
-
感谢告知,我没注意到。
标签: python twitter web-scraping beautifulsoup python-requests