【发布时间】:2021-06-30 12:50:39
【问题描述】:
我正在尝试从 Dropbox 链接 (https://www.dropbox.com/s/i77mern7joxc9ur/TestResultCodelistVoC.xlsx) 解析表格。这是一个.xlsx 表,到目前为止我已经尝试了两种方法
方法一
codeID_url = 'https://www.dropbox.com/s/i77mern7joxc9ur/TestResultCodelistVoC.xlsx'
tables = pd.read_html(codeID_url)
df_codeID = tables[0]
给予
ValueError: No tables found
这是有道理的,因为最后,我不是从 html 页面解析表格。上面的命令非常适合本页中的表格 (https://www.ecdc.europa.eu/en/covid-19/variants-concern)
方法 2
codeID_url = 'https://www.dropbox.com/s/i77mern7joxc9ur/TestResultCodelistVoC.xlsx'
data = pd.read_excel(codeID_url,'TestResultCodelistVoC')
给予:
XLRDError: Unsupported format, or corrupt file: Expected BOF record; found b'<!DOCTYP'
我确实找到了关于同一错误 here 的主题,尽管所有答案都在处理 local .xls 文件,而在我的情况下,我正在尝试解析网页/链接,最后是一个.xls 文件。
我也遇到了一个使用 dropbox token 的解决方案,但我首先想尝试在没有 Dropbox 帐户的情况下下载上述表格。
【问题讨论】:
标签: python excel pandas dropbox