【发布时间】:2022-01-19 17:14:35
【问题描述】:
我正在使用 Pandas 从 S3 读取 excel 文件 (.xls)。该代码适用于一些文件,但对于其余文件则不能。每天收到的文件每天都有不同的值(excel文件结构相同,所以我们可以认为文件相同)。
错误是:
ValueError:无法确定 Excel 文件格式,您必须手动指定引擎。
在这一行:
pd.read_excel(io.BytesIO(excel), sheet_name=sheet, index_col=None, header=[0])
我已经尝试了互联网上提到的所有解决方案:指定 engine='openpyxl' 会出现错误:
zipfile.BadZipFile:文件不是 zip 文件
并指定engine='xlrd' 会出现错误:
预期的 str、字节或 os.PathLike 对象,而不是 NoneType
我正在使用 boto3 连接到 S3 资源。 再一次,对于一些文件,我的代码工作正常。 看起来相同的 excel 文件出现这种不同行为的原因可能是什么?
我的问题与Excel file format cannot be determined with Pandas, randomly happening 非常相似,但还没有正确的答复。
【问题讨论】:
标签: python pandas amazon-s3 boto3