【发布时间】:2021-05-26 07:06:40
【问题描述】:
我从事数据科学。我有一个 .csv 文件,其中包含 5kk 条记录和 3.9gigas 大小。处理它的最佳做法是什么?我通常使用 vscode 或 jupyter,即使我将 max-memory 设置为 10gigas,加载等操作也需要花费太多时间才能完成。
你有什么建议来改进我的工作?
notebook lenovo S145 20gigas ram i7-8565U - Ubuntu
谢谢
【问题讨论】:
标签: sql python-3.x pandas visual-studio-code data-science