【发布时间】:2011-08-04 12:17:44
【问题描述】:
有人可以建议执行以下操作的最佳方法吗?
我有三个变量(X、Y 和 Z)和四个组(1、2、3 和 4)。我一直在 SPSS 中使用判别函数分析来预测已知分组数据的组成员资格,以便与未来的未分组数据一起使用。
理想情况下,我希望能够对越来越多的数据子集进行随机抽样,以查看需要多少次观察才能达到所需的正确分类百分比。
但是,我知道这可能很困难。因此,我正在寻找这样做的手段。
例如,假设变量 X 对于组 1 的平均值为 141。这个平均值可能是根据 2000 次观察计算得出的。但是,平均值可能出现在 700 次观察中。我希望能够计算出我的数据中平均水平的观察/案例数量。例如,可能从 10 次观察开始,然后随机重复 50 或 100 次,然后增加到 20 次观察......等等。
我知道这是蒙特卡罗测试的一种形式。我可以访问 SPSS 15、17 和 18 以及 excel。我还可以访问 minitab 15 & 16 和 amos17 并下载了“R”,但我不熟悉这些。我的经验是使用 SPSS 和 excel。我已经在 SPSS Modified from this..http://pages.infinit.net/rlevesqu/Syntax/RandomSampling/Select2CasesFromEachGroup.txt 中尝试了一些语法,但这对我来说输入子集号等仍然很耗时。
希望有人可以提供帮助。
感谢阅读。
安迪
【问题讨论】:
-
R 非常适合做这类事情。如果您看到自己将来会做更多此类事情,那么值得学习如何使用它。如果我使用 R,我会随机选取一组中的一大堆随机子集,子集的大小从小到大,并计算它们的平均值。然后我将它们全部绘制在均值/子集大小的图表上,看看它们是否收敛到任何东西。在任何真正的编程语言中实现这一点都很简单,但在类似 excel 的程序中很难做到。
标签: subset montecarlo spss sampling mean