【发布时间】:2021-02-12 12:52:33
【问题描述】:
我正在处理一个包含 x、y 和 z 的相当大的数据集。 x 和 y 放在散点图上,z 设置为颜色条值。有 24 个不同的列,每列有 ~20000 个点。我正在尝试确定与 y 值相关的主要 z 值,但我不想误导我在生成的图像中看到的清晰颜色。鉴于 1 列中有这么多标记,我想知道 Matplotlib 如何确定哪些标记覆盖在其他标记之上。
这可能很难想象,所以这是我的代码和输出的图像。如果我们查看 ~24 小时,我们会看到主要的低海拔着色,但我不想假设高海拔被低海拔值覆盖。假设低海拔在那个时间段内占主导地位是错误的,还是我应该尝试澄清一些事情?请记住,单列中大约有 20000 个点,因此掩盖的可能性不为零。
我还没有找到关于这个问题的明确答案,所以我非常感谢任何帮助
【问题讨论】:
-
始终提供minimal reproducible example,包含代码、数据、错误、当前输出和预期输出,如formatted text、Not Screenshots。这个问题很可能会被否决并关闭。您不鼓励提供帮助,因为没有人愿意重新输入您的数据或代码,而且屏幕截图通常难以辨认。 edit 问题并添加文本。请参阅How to provide a reproducible copy of your DataFrame using
df.head(30).to_clipboard(sep=',')。
标签: python matplotlib plot scatter-plot scatter