【发布时间】:2020-03-02 21:35:29
【问题描述】:
我在 Google Cloud Platform VM 实例上使用 Jupyter notebook。
我完成工作,停止实例并在第二天早上重新启动 vm 和 Jupyter Notebook,我必须从顶部重新运行所有代码,这很烦人,因为我必须加载所有数据集,这需要 30 分钟。
我四处搜索,发现这些代码可以工作,但即使我把它放在我的笔记本顶部,仍然会出现同样的问题。
%reload_ext autoreload
%autoreload 2
有什么方法可以将所有内容保存在 jupyter notebook 中,以便我可以拿起并运行它?
【问题讨论】:
-
可能的解决方法:将数据集存储在 pickle 文件中。
-
@AntonvBR 我正在从 GCP 存储中提取数据集。从我的存储桶中,我将数据集安装到 vm 实例中的目录。我就是这样读取数据的。我还能将这些数据存储在 pickle 文件中吗?
-
我的意思是你可以通过存储感兴趣的变量来更快地继续你离开的地方。