【发布时间】:2020-01-02 20:11:30
【问题描述】:
我们使用 memsql 列式存储数据库。 我们为后端架构中的每个“偶数类型”创建管道,并为它创建一个专用表(我们称之为“源表”)。所以每个管道都会写入 memsql 上的一个表(又名源表)
我们为客户提供不同的业务报告,其中包含来自多个源表的数据(不是我们可以加入的必要表,因为有些字段可以存在于一个表中而有些则不存在)
因此,克服这个问题的唯一方法是创建包含 UNION 函数的庞大而复杂的查询,这使得事情变得难以维护和理解
什么是维护和保持这种架构的最佳实践,这将允许我们在多个源表上创建多个报告并降低查询复杂性。
我们认为的一种方法是对每个报告进行专门的查看。但我们不确定我们是否会走这条路。我们需要创建外部 ETA,它将向该视图添加越来越多的数据(日常流程) 您对此有何看法?这可能是一种方式吗?
使用 UNION 函数处理大量查询的第二种方法(在运行时) 我们不喜欢这种方式,因为它在查询时运行时运行复杂
我想提一下,这些报告不需要实时更新。我们可以从一个更新到另一个缓冲(小时)
想法?
【问题讨论】:
-
为什么要添加 amazon-redshift 标签?如果不相关,请删除。
-
因为它基于相同的技术.. columnstore 数据库
标签: mysql bigdata data-warehouse singlestore