【问题标题】:How do I avoid reruning all the code when I restart Jupyter notebook重新启动 Jupyter 笔记本时如何避免重新运行所有代码
【发布时间】:2020-03-02 21:35:29
【问题描述】:

我在 Google Cloud Platform VM 实例上使用 Jupyter notebook。

我完成工作,停止实例并在第二天早上重新启动 vm 和 Jupyter Notebook,我必须从顶部重新运行所有代码,这很烦人,因为我必须加载所有数据集,这需要 30 分钟。

我四处搜索,发现这些代码可以工作,但即使我把它放在我的笔记本顶部,仍然会出现同样的问题。

%reload_ext autoreload
%autoreload 2

有什么方法可以将所有内容保存在 jupyter notebook 中,以便我可以拿起并运行它?

【问题讨论】:

  • 可能的解决方法:将数据集存储在 pickle 文件中。
  • @AntonvBR 我正在从 GCP 存储中提取数据集。从我的存储桶中,我将数据集安装到 vm 实例中的目录。我就是这样读取数据的。我还能将这些数据存储在 pickle 文件中吗?
  • 我的意思是你可以通过存储感兴趣的变量来更快地继续你离开的地方。

标签: python jupyter-notebook


【解决方案1】:

对于任何有兴趣的人,

我使用了名为'dill'的python库

dill.dump_session('notebook_env.db') dill.load_session('notebook_env.db')

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2018-03-05
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多