【问题标题】:combining observations based on a criteria in R [duplicate]基于R中的标准组合观察[重复]
【发布时间】:2015-12-06 04:10:24
【问题描述】:

我有一个如下所示的数据集:

    geoid   zip dealers Year    County
    1001    36703   1   2001    Autauga County, AL
    1001    36704   3   2001    Autauga County, AL
    1003    36535   7   2000    Baldwin County, AL
    1003    36536   3   2000    Baldwin County, AL

我想获取除“dealers”和“zip”之外的所有相同行,并将它们组合成一行,其中经销商变量从所有相似行中求和。 (我不确定用 zip 做最简单的事情是什么,要么全部列出,要么将其省略?没关系。)所以这会变成:

    geoid   dealers Year    County  
    1001    4   2001    Autauga County, AL
    1003    10  2000    Baldwin County, AL

有没有办法像这样创建一个新的数据集? (顺便说一句,我是通过合并三个数据集来到这里的,所以如果有更好的方法可以在不创建这些重复项的情况下进行合并,那也会很有帮助。)

【问题讨论】:

  • 你的问题更多是关于aggregate而不是merge

标签: r aggregate


【解决方案1】:

这会给你想要的结果:

df <- read.table(header=TRUE, text=
'geoid   zip dealers Year    County
1001    36703   1   2001    "Autauga County, AL"
1001    36704   3   2001    "Autauga County, AL"
1003    36535   7   2000    "Baldwin County, AL"
1003    36536   3   2000    "Baldwin County, AL"')

aggregate(dealers ~ geoid+Year+County, data=df[-2], FUN=sum) # or
aggregate(dealers ~ geoid+Year+County, data=df, FUN=sum)

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2021-11-10
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多