【问题标题】:Plotting a graph where the majority of input data is very small but has large outliers绘制大部分输入数据非常小但具有较大异常值的图表
【发布时间】:2021-04-14 15:04:32
【问题描述】:

所以我有一个从用户那里获取数据的应用程序。 95% 的数据将在很小的范围内,例如 0.411-0.412,具体取决于用户。

我的问题是,经常会有数据超出该范围,例如 3 或 4,这在绘制图表时会出现问题,因为它会拉伸到最大值,这意味着您无法将数据视为好吧。

例如样本数据[0.41,0.41,0.412,0.4112,0.415,0.415,0.4111,0.419,0.416] 将产生:

但如果我们在该数据中添加 4,则图表将生成:

对此有什么解决方法? y 轴标签分为 3 类,cat1 cat2 cat3 取决于读数,例如 0.41 是 cat1 0.42 是 cat 3,然后任何高于 0.44 的都是 cat3。

我尝试通过查找整个数据集的平均值并将高于平均值 0.5 的任何值更改为平均值 +0.5 来限制数据。我不确定这是否是最好的方法,因为每个用户都有不同的读数,高于平均值 0.5 对某些人来说可能仍然是 cat2。

感谢任何建议。

【问题讨论】:

    标签: math graph


    【解决方案1】:

    使用对数刻度通常是解决此问题的好方法。图表中的每个主要部分都可能是价值的两倍,或者是 10 倍的增长。 (y 刻度变为 log₂(y) 或 log₁₀(y)。)

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2020-01-03
      • 1970-01-01
      • 2011-05-19
      相关资源
      最近更新 更多