【发布时间】:2021-09-09 12:06:18
【问题描述】:
我想从“Bonds Traded on the Exchange”和“OTC trades”中提取表格并将其保存到 Excel 表中。 我正在尝试使用 python ( BS & requests ) 抓取数据,但我无法抓取数据 ( 我不想使用 selenium )。任何人都可以指导我吗? 我没有收到任何错误,它没有在 python 终端中得到处理 我认为终端被挂起,因为我什至没有收到任何错误消息。
import requests
import pandas as pd
import os
from bs4 import BeautifulSoup as bs
url = "https://www1.nseindia.com/products/content/debt/corp_bonds/cbm_reporting_homepage.htm"
#condition True
#while condition:
html = requests.get(url).content
page= requests.get(url)
soup= bs(page.text, 'lxml')
df_list = pd.read_html(html)
df = df_list[0] # can change 0 to other number
print(df)
【问题讨论】:
-
您收到 403 响应了吗?如果是,请尝试用户代理。
-
我没有得到任何用户响应,网站正在浏览器中打开,但没有通过 python 获取..selenium 工作但速度很慢............什么是用户代理?
-
您没有向我们提供足够的信息来帮助您。你得到什么样的错误信息和响应代码?在您的问题中包含此类信息非常重要。
-
我没有收到任何错误,它没有在 python 终端中得到处理
-
你在代理/防火墙后面吗?
标签: python python-3.x python-2.7