【问题标题】:Tensorflow Dataset API: dataset.batch(n).prefetch(m) prefetches m batches or samples?Tensorflow 数据集 API:dataset.batch(n).prefetch(m) 预取 m 个批次或样本?
【发布时间】:2018-09-17 07:47:04
【问题描述】:

如果我使用

dataset.batch(n).prefetch(m), 

m 个批次或 m 个样本将被预取?

【问题讨论】:

    标签: tensorflow-datasets


    【解决方案1】:

    Dataset.prefetch(m) 转换预取其直接输入的m 元素。在这种情况下,由于它的直接输入是dataset.batch(n),并且该数据集的每个元素都是一个批次(n 元素),因此它将预取m批次

    【讨论】:

    • 非常感谢!顺便问个问题:dataset.map(map_func, num_parallel_calls=num_threads) 如果num_threads > 1会影响数据顺序吗?
    • 只要map_func 是一个纯函数(即它不指代变量或随机数生成器等可变状态),那么无论有无num_parallel_calls > 1,输出都应该相同。跨度>
    • 嘿,@mrry,参数名称“buffer_size”和 api_doc“创建一个从该数据集中预取元素的数据集。”误导用户,可以更清楚。
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2018-12-14
    • 1970-01-01
    • 2018-10-21
    • 1970-01-01
    相关资源
    最近更新 更多