【发布时间】:2020-11-09 20:09:40
【问题描述】:
我正在使用 tabula-py 从一些 pdf 中读取数据,但一直收到此错误。
发生异常:ParserError 标记数据时出错。 C 错误:第 51 行中应有 1 个字段,但看到了 2
我正在阅读的 PDF 与我构建此代码的 PDF 几乎完全相同。例如,我在使用另一个 PDF 进行测试时构建了它,现在正在更改为具有相同格式和样式的新更新,但代码现在失败并抛出此错误。
不知道我做错了什么/为什么以前有效的代码不再有效。
代码sn-p:
tabula.convert_into_by_batch("-----", stream = True, output_format='csv', pages='11-57')
path = ("-------")
filenamelist = os.listdir(path)
updated_path = path+ "\\" + filenamelist[0]
new_frame = pd.read_csv(updated_path, skiprows=2, encoding='ISO-8859-1') #error thrown here
【问题讨论】:
-
不确定它是否与错误有关,但您应该使用
os.path.join(path,filenamelist[0])来代替“手动”连接路径,不同的操作系统使用不同的符号来路径,并且在 linux 中运行的代码可能在 Windows 中失败