【发布时间】:2017-08-22 13:26:12
【问题描述】:
我有一个永远不会改变的大型数据集(我从不直接修改它)。我从 pandas 开始阅读
dataset = pandas.read_csv(filepath)
然后我做一些数据分析。初始文件加载大约需要 10 秒,我目前每次在数据分析部分更改某些内容时都会重新运行它。如何一劳永逸地加载数据并只运行分析部分?
【问题讨论】:
-
您可以探索 iPython 之类的环境,这些环境具有类似于 MATLAB 的类似工作区的功能。
-
标准库中有一个您可能会发现有用的函数:
importlib.reload重新加载以前导入的模块。但是 Python 的版本在这里很重要:这个函数在 Python 2.x 系列的更高版本中,在 V3.x 中被删除了一段时间,在 3.4 中又回来了。检查文档以了解您使用的任何版本。