【发布时间】:2019-12-25 18:18:38
【问题描述】:
我正在使用 pandas.read_csv() 和 chunksize = 500000 读取大的 csv 文件。 由于我使用的是块大小,因此“skipfooter=1”选项不适用于块大小,因为它返回的是生成器而不是数据帧。
在读取块时从文件中跳过页脚记录的最佳方法是什么?
【问题讨论】:
-
为什么不能在事后将它们子集出来?
-
不确定如何跟踪最后一个块以删除页脚行。
-
您要删除每个块的页脚吗?
-
不,只从最后一个chunk开始。Footer是整个文件的最后一条记录,大小超过3GB。
-
我的意思是,在您阅读完所有内容后,只需放下页脚。
标签: python python-3.x pandas csv