【发布时间】:2021-02-27 07:29:29
【问题描述】:
我想问一下pentaho是否可以这样做
我昨天 26/02/2021 的数据看起来像这样,START_DATE TAKEN FROM SYSDATE
ID|CODE|NAME|MARKS|START_DATE|END_DATE
1|A01|KUMAR|90|26/02/2021|NULL
2|A02|RAJESH|80|26/02/2021|NULL
3|A03|SINGH|70|26/02/2021|NULL
假设 SINGH 的代码为 A03,他在 27/02/2021 获得了更好的分数(90),所以它看起来像这样
ID|CODE|NAME|MARKS|START_DATE|END_DATE
1|A01|KUMAR|90|26/02/2021|NULL
2|A02|RAJESH|80|26/02/2021|NULL
3|A03|SINGH|70|26/02/2021|27/02/2021
4|A03|SINGH|90|27/02/2021|NULL
由于 SINGH 在其 MARKS 中的值不同,因此 SINGH 的旧记录将满足它的 END_DATE,而具有最新 MARKS 的 SINGH 新记录将在插入记录的当天有 START_DATE,并且他的 END_DATE 仍然为空。所以作业将查看它的值是否有任何差异,然后如果有一些差异,则表示该行具有“更新”值,并且将插入源中的最新值。 我可以在 pentaho 中实现它吗?
【问题讨论】:
标签: etl pentaho data-warehouse pentaho-spoon pentaho-data-integration