【问题标题】:Please help me with my proportions assignment for statistics请帮我完成我的统计比例分配
【发布时间】:2023-04-03 00:12:02
【问题描述】:

数据集命令:

download.file("http://www.openintro.org/stat/data/atheism.RData", destfile ="atheism.RData")
load("atheism.RData")

问题: 根据数据集,美国无神论者的比例是多少(百分比,四舍五入到小数点后两位)?

这就是我所做的:

我使用 sum() 函数得到无神论者的总数,然后除以无神论者+非无神论者的总数。听起来对吗?例如:(无神论者)/(无神论者+非无神论者)

我的回答是:

0.05

第二个我希望得到帮助的问题:

无神论者样本比例的置信区间的标准误是多少(四舍五入)?

我的答案:0.0158

公式就是sqrt((p(1-p)/N))。

我不认为我得到了 p 所以我默认使用 0.5。 所以,SQRT((0.5)(1-0.5)/1002)),无神论者+非无神论者加起来得到1002,就是总大小N。

看起来不错???

【问题讨论】:

  • 这看起来不像是一个编程问题。您可能想查看教科书以了解如何根据样本比例计算标准误差。或者您可能会阅读 ?help。

标签: r statistics


【解决方案1】:

正如@Elin 所说,这更多是统计问题,而不是编程问题。此外,开放式介绍是一个很好的统计文本,所以去阅读吧!

现在,既然您问的是 R 问题,这里有一些关于 R 的信息,您应该知道以解决这个问题。但是,由于它是硬件,我不会为您编写解决方案。从长远来看,这对您没有帮助!

首先,要计算有多少元素具有某个级别的因子,您可以利用 R 将布尔值视为 1 和 0 的事实。因此,您可以将布尔向量相加得到一个计数。

例如,iris 数据集(有关详细信息,请参阅“?iris”)具有因子 Species。要获取具有“setosa”级别的 Species 变量的数量,请运行:

sum(iris$Species== "setosa")

要得到比例,你可以除以变量的长度:

sum(iris$Species== "setosa") / length(iris$Species)

请注意,对我而言,length(atheism$response) 返回 88032,而不是 1002。通过添加两个无神论 $response 级别,我得到了相同的结果。我建议你仔细检查一下这是不是同一个数据集。

您需要自己计算标准误差。我建议仔细阅读文本和问题,因为我怀疑 0.5 不是 p 的正确值。

另外,关于 R 中的算术的注释。操作顺序已明确指定,但可能会让新用户感到困惑。我建议尽可能使用括号。此外,即使是 a * (b + c) 形式的乘法也需要 '*' 运算符——它不像在代数 a (b + c) 中那样假设。

如果您有更多 R 问题,请随时提问。但是,您必须学习统计数据! Open intro 是一本很棒的书,所以好好利用它!!!

【讨论】:

    猜你喜欢
    • 2012-03-31
    • 2015-03-27
    • 2011-09-16
    • 1970-01-01
    • 2023-01-13
    • 1970-01-01
    • 2011-01-14
    • 2017-04-09
    • 1970-01-01
    相关资源
    最近更新 更多