【发布时间】:2021-08-27 16:37:56
【问题描述】:
我在从 Google BigQuery 获取大量数据的报告中实现了增量刷新。问题是每次增量刷新都会产生重复的查询,其中一个非常昂贵。
正如 Chris Webb 在his article 中所述,Power BI 进行两次查询以从 SQL 数据库导入数据;一个返回有限数量的行只是为了发现表模式,另一个是为了获取实际数据。
在许多 SQL 服务器中,这只会影响性能,但在 BigQuery 中,无论结果行数是多少,处理的数据量都是收费的,第一次查询会花费很多,因为查询折叠是没有发生。
在这里,我对较小的数据集进行了一些实验,以显示正在发生的事情:
请注意,上面的“发现查询”处理 121.66 MB 以仅返回一行,而下面发生查询折叠的“数据查询”仅处理 7.35 MB。
我实施了修改我的 M 代码的 Chris 解决方案,但 BigQuery 仍然收到重复的查询。有什么办法可以避免“发现查询”??
【问题讨论】: