【发布时间】:2020-04-30 15:37:03
【问题描述】:
我有一个包含 10 个变量和 12,000 个观测值的大型数据集,来自 3 种不同的系统(200 个来自小池塘,600 个来自河流,11200 个来自湖泊)。我的数据框中有很多 NA,但仍想执行 PCA 以查看系统的不同之处,仅使用我的数据框的最后 4 列(第一列描述站点,最后四列是化学数据) .
有什么办法可以解决这个问题吗?
【问题讨论】:
-
嗨,这个问题的性质似乎更具统计性。我建议您将其发布在 Cross Validated 上,而不是在 Stack Overflow 上。
标签: r pca missing-data