【发布时间】:2020-04-17 12:33:14
【问题描述】:
我有一个巨大的文本文件,其中有 1.8 亿行,如下所示:
我想用 pandas 读取这个文本文件,但只读取“pdate”位于特定范围内的行。例如,我想读取“日期”在 981225 和 981229 之间的行。 由于整个文本文件很大,我不想阅读整个文件然后设置条件。 我只想阅读那些我的条件对它们正确的行。此外,我需要最快的方法,而不是逐行读取文件。 有什么解决办法吗?
【问题讨论】:
-
逐行阅读有什么意义?
-
这能回答你的问题吗? conditional row read of csv in pandas
-
@AlexandreB。符合我条件的行大约有 1 亿行,我认为逐行阅读它们需要时间。
-
@qaiser 实际上我猜“unutbu”答案中没有原因,“chunks”变量以块的形式读取整个文件,然后在其上应用“有效”函数并在“jpp”答案中,文件已被逐行读取。