【发布时间】:2014-01-14 17:37:04
【问题描述】:
我有 2 个数据框:“start.date”和“death.date”。每个包括 2 列“numid”(一个数字 id)和一个“date”列。 “start.date”是记录每个 numid 疾病开始的数据集。 "death.date" 仅包括 "start.date" 中在 death.date$date 中的日期死亡的那些 numid。
我需要计算那些具有相同 numid 的 start.date 和 death.date 之间的差异(=survival)。
这是我写的:
tempi<-as.numeric(factor(start.date$numid))
tempj<-as.numeric(factor(death.date$numid))
for(i in tempi){
for(j in tempj){
surviv[i]<-ifelse(colic.date$numid[i]==death.date$numid[j],
death.date$date.death[j]-colic.date$date.colic[i],
"alive")
}
}
我认为我的问题是 surviv[i] 只保留 death.date$numid[j] 的最后一个值,但我找不到出路。任何人都可以对此有所了解吗? 可能有更简单的方法可以做到这一点(运行速度非常慢 - 即使结果错误)
抱歉,如果在某处讨论过这个问题,我只是找不到任何适用于我的数据的东西。
干杯 马可
【问题讨论】: