【问题标题】:Is there a way to create a fake dataset which can satisfy expected effects?有没有办法创建一个可以满足预期效果的假数据集?
【发布时间】:2019-07-27 16:08:47
【问题描述】:

我需要创建一个假数据集。我知道变量,它们可以取的值的范围,并且对它们的影响大小有一个粗略的了解(因此也是影响的方向)。你知道是否有办法做到这一点吗?

谢谢!

我创建了一个闪亮的 flex 仪表板,它应该显示一个人购买产品的可能性取决于他/她的特征,以及使用更多数据如何提高预测的准确性。 我必须展示仪表板才能访问真实数据。但是,我知道变量及其对因变量的影响方向。 DFgen oder charlata 没有任何帮助!

【问题讨论】:

    标签: r dataset logistic-regression


    【解决方案1】:

    您可以使用sample。这是一个例子:

    set.seed(1)
    ids <- sample(10000, 50) # create a sample of length 50 from the numbers up to 10000
    var1 <- sample(seq(0, 10, 1), 50, replace = TRUE) # the range of values are between 0 and 10
    var2 <- sample(seq(10, 500, 20), 50, replace = TRUE) 
    var3 <- sample(c("F", "M"), 50, replace = TRUE)
    effect <- sample(c(0,1), 50, replace = TRUE) # if you have an idea on the effect, you can apply some if statements here.
    # 
    df <- data.frame(id = ids,
                     v1 = var1,
                     v2 = var2,
                     v3 = var3,
                     res = effect)
    

    这应该可以帮助您入门。您可以根据需要更改大小,而不是 50 选择合适的大小。

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2013-10-14
      • 2013-07-19
      • 1970-01-01
      • 2011-02-20
      相关资源
      最近更新 更多