【发布时间】:2017-06-18 11:49:42
【问题描述】:
我是张量流的新手。我的数据库中有大量数据,我想要一种方法来训练数据上的张量流模型。如果我将数据写入 csv 文件然后从 csv 读取数据,我了解如何执行此操作。 但是我如何直接从数据库中执行此操作。我可以从我的脚本(python)连接到数据库并运行 SQL 查询来检索数据,但是如果我想分批或分期学习并混合数据? 此外,数据太大而无法一次全部保存在内存中。 关于从哪里开始的任何提示? 谢谢
【问题讨论】:
-
是否有什么阻止您多次查询数据库?为什么不能只运行对您的情况有意义的任何大小限制的选择语句,然后从返回的行创建小批量?然后,在您对每一行运行 SGD 步骤后,运行另一个查询并创建更多小批量。也许我错过了您遇到的困难。
标签: python database tensorflow bigdata