【问题标题】:INFO:tensorflow:Waiting for new checkpoint at models/faster_rcnn信息:张量流:在模型/faster_rcnn 等待新的检查点
【发布时间】:2021-06-29 06:17:12
【问题描述】:

我使用迁移学习方法开发了一个使用 faster_rcnn 算法的检测模型。

为了评估我的模型,我使用了以下命令-

!python model_main_tf2.py --model_dir=models/faster_rcnn_inception_resnet_v2 --pipeline_config_path=models/faster_rcnn_inception_resnet_v2/pipeline.config --checkpoint_dir=models/faster_rcnn_inception_resnet_v2

但是,我收到以下错误/信息消息:-

INFO:tensorflow:Waiting for new checkpoint at models/faster_rcnn_inception_resnet_v2
I0331 23:23:11.699681 140426971481984 checkpoint_utils.py:139] Waiting for new checkpoint at models/faster_rcnn_inception_resnet_v2

我检查了 checkpoint_dir 的路径是否正确。可能是什么问题,我该如何解决?

提前致谢。

【问题讨论】:

    标签: google-colaboratory tensorflow2.0 transfer-learning faster-rcnn


    【解决方案1】:

    类似的情况也发生在我身上。我不知道这是解决方案还是只是一种解决方法,但它确实对我有用。我只是导出了我的模型并提供了该检查点文件夹的路径。

    fintune_checkpoint_model_directory
       |
       \---checkpoint(folder)
           |
           \---checkpoint(file with no extension)
           \---ckpt-1.data0000of0001
           \---ckpt-1.index
    
    

    然后简单地运行 model_main_tf.py 文件进行评估。

    【讨论】:

    • 这不是他已经做的:--checkpoint_dir=models/faster_rcnn_inception_resnet_v2
    【解决方案2】:

    如果你用几个步骤训练你的模型,这可能是一个问题,也许几个检查点会影响 TensorFlow 无法生成评估,因此请尝试增加步骤数

    【讨论】:

      【解决方案3】:

      您需要运行另一个脚本进行训练以生成新的检查点。 model_main_tf2.py 不会同时做这两件事,即它不会在每个 epoch 结束时训练模型和评估模型。

      一种在https://github.com/tensorflow/models/blob/13ec3c1460b928301d208115aed0c94fb47538b7/research/object_detection/model_lib_v2.py#L445 中修改 checkpoint_max_to_keep 的方法 保留所有检查点,然后分别评估。这与您想要的不完全一样,但它会生成曲线。

      【讨论】:

        猜你喜欢
        • 1970-01-01
        • 2018-06-16
        • 1970-01-01
        • 2021-09-08
        • 1970-01-01
        • 1970-01-01
        • 2021-09-13
        • 1970-01-01
        • 2019-05-08
        相关资源
        最近更新 更多