【发布时间】:2020-01-31 06:35:39
【问题描述】:
从pdf文件中提取文本的最佳方法是什么..... 我试过一些 PyPDF2 -----> 它只为所有页面返回一个空字符串 tabula -----> 它返回一个奇怪的 NaN 表 我试图 scrape 的 pdf 是 http://imdagrimet.gov.in/sites/default/files/daas_bulletin/Vaishali_46.pdf
【问题讨论】:
-
参考here