【发布时间】:2017-02-04 15:07:25
【问题描述】:
为以下问题寻找一个简单的解决方案 这就是我的数据的样子:
ClientID PatientID Measure Value CollectionDatetime
41 123456 Temperature 87 02-04-2017
41 123456 WBC 1000 02-04-2017
41 123456 Temperature 83 02-05-2017
41 23456 WBC 10000 02-04-2017
41 23456 RR 100 02-04-2017
41 23456 C-Ceratine 90 02-05-2017
41 23456 Temperature 87 02-06-2017
41 23456 Temperature 89 02-06-2017
这就是我想要的输出:
ClientID PatientID Measure Value CollectionDatetime Label
41 123456 Temperature 87 02-04-2017 1
41 123456 WBC 1000 02-04-2017 1
41 123456 Temperature 87 02-04-2017 2
41 123456 WBC 1000 02-04-2017 2
41 123456 Temperature 83 02-05-2017 2
41 23456 WBC 10000 02-04-2017 1
41 23456 RR 100 02-04-2017 1
41 23456 WBC 10000 02-04-2017 2
41 23456 RR 100 02-04-2017 2
41 23456 C-Ceratine 90 02-05-2017 2
41 23456 WBC 10000 02-04-2017 3
41 23456 RR 100 02-04-2017 3
41 23456 C-Ceratine 90 02-05-2017 3
41 23456 Temperature 87 02-06-2017 3
41 23456 Temperature 89 02-06-2017 3
应根据患者 ID 和 CollectionDatetime 复制数据。 对于每个 Patient ID,如果是第 1 天一次,第 2 天应该有第 1 天和第 2 天的数据,以此类推
【问题讨论】:
-
你是如何得到标签的?
-
似乎不清楚。关于重复值和构造“标签”的规则需要扩展。
-
看起来像一个扩展窗口;每个日期应包含当前日期和所有先前日期的行,按 ClientID 分组。这个例子当然可以更简洁。
标签: r function dataframe duplicates apply