【发布时间】:2014-07-25 11:03:42
【问题描述】:
我有一个数据框,总结了三年(2006,2007,2008)的不同类序列,变量count表示一个类序列出现的次数:
df<-data.frame(count=c(150,33,35,26,15,65),
Y.2006=c("a","a","a","d","d","d"),
Y.2007=c("a","b","b","c","c","c"),
Y.2008=c("a","b","a","c","c","d") )
看起来像:
count Y.2006 Y.2007 Y.2008
1 150 a a a
2 33 a b b
3 35 a b a
4 26 d c c
5 15 d c c
6 65 d c d
我计算2006-2007的序列:
df$Y.2006_2007<-paste(df$Y.2006, df$Y.2007)
结果:
count Y.2006 Y.2007 Y.2008 Y.2006_2007
1 150 a a a a a
2 33 a b b a b
3 35 a b a a b
4 26 d c c d c
5 15 d c c d c
6 65 d c d d c
我想要 2008 年不同类别的 Y.2006_2007 的出现次数。 所以我这样做:
table(df$Y.2006_2007, df$Y.2008)
导致:
a b c d
a a 1 0 0 0
a b 1 1 0 0
d c 0 0 2 1
现在,我想根据初始数据帧 (df) 的计数变量更新这些结果,以考虑类序列的出现次数。所以我想:
a b c d
a a 150 0 0 0
a b 35 33 0 0
d c 0 0 41 65
我不知道如何实现这个结果。有什么想法吗?
【问题讨论】: