【发布时间】:2021-10-26 12:17:41
【问题描述】:
我知道在数据表中读取 csv 文件比 pandas DataFrame 快得多。
然而,就我而言
我有几个 csv 文件,我必须一一追加。
所以我正在将所有这些 pd.read_csv(file) 附加到空 DataFrame。
读取带有数据表的csv文件并将其附加到空数据表会更快吗
然后最终将最终数据表转换为 csv?
所以我想知道除了 pandas DataFrame 之外的最快的追加 csv 文件的方法
【问题讨论】:
-
请分享您如何在数据表与熊猫中执行此操作的代码,以便我们更好地理解您的意思并提出可能的解决方案。另外,请将标签更改为 py-datatable
-
另外,您可以使用
fread或iread(多个文件的延迟读取)读取所有文件,并使用dt.rbind将它们合并为一个。同样,共享您的代码或一些示例数据框会很有帮助。不确定我撰写的 blog post 是否会有所帮助。
标签: pandas dataframe py-datatable