【发布时间】:2015-12-17 01:28:07
【问题描述】:
我正在使用带有 Rstudio 的 Windows7。我有一个数据框,其中有几列包含 4 个答案或 NA 的因子混合(4 个答案,选择所有适用或选择无)。我有一个地狱般的时间来划分级别,以便我可以知道有多少受访者选择了。
data<- c("cats", "dogs", "cats, dogs", "cats, dogs, birds(with, commas, randomly)")
data<-data.frame(as.factor(data))
df<-as.data.frame(cbind((1:100),data))
df[,1]<-NULL
df
我如何表明用户选择了狗(一个级别)和猫(另一个级别),而不是选择狗和猫(作为一个级别,分开狗和/或猫)?
也就是说,我如何显示: 狗是 1 猫是 2 狗和猫是1,2 狗、猫和鸟是 1,2,3,当然不会遇到逗号问题,如果必要的话也可能以其他方式出现
我在 Google 上上下搜索过,但就是不明白。我无法正确使用 mChoice 函数(Hmisc 包)并且遇到各种问题。我希望我能在这门课程中找到解决方案,特别是,但我相信无济于事。
感谢您的帮助。
【问题讨论】:
-
你真的需要100行样本数据吗?也请用给定的输入显示所需的输出。
-
那么想要的结果是什么?最后一个字符串中有
(with, commas, randomly)。是保留还是删除?
标签: r