【发布时间】:2016-06-03 13:12:35
【问题描述】:
我有两个测量仪器创建的两组数据,每个仪器给出时间列和电压列,而这两组数据代表相同的时间量(或非常接近),它们存储在不同大小的数组中因为采样时间不同。 我想获得 scipy.stats.pearsonr 系数,但要做到这一点,我需要两个数据集的大小相同。
如何将两个集合中较小的大小缩放为两个集合中较大的大小,以便用更多数据点表示相同的数据?
编辑。
对不起,我应该提供一个数据示例,我最初没有提供,因为文件中有额外的数据,我认为它会引起人们对我遇到问题的关注。
名为 OOL_Drift.dat 的文件包含我想知道的数据是否与 TemperatureChannels.txt 和 Room_Temperature.txt 中包含的温度读数相关。 每个文件的第一列是时间。 OOL_Drift.dat 的第二列包含我要比较的数据。 TemperatureChannels.txt中的第4、8、12、16、20列包含要比较的数据。
这里是文件 https://drive.google.com/folderview?id=0B_viQkcWo4Z2LUlyVG82eWpmUXM&usp=sharing
由于我有很多样本,而且读数不会很快改变,我认为它应该可以工作。
感谢大家提出的建议
【问题讨论】:
-
如果您确定要这样做,@npielawski 已为您提供了如何操作的想法。但是,我认为您应该认真考虑是否要全部完成。您自己说过“相同的数据用更多的数据点表示”,严格来说,这是完全不可能的。如果两个采样频率都比您要比较的信号高很多,那么(可能)会很好。但是,如果数据非常嘈杂或者您的测量结果非常混乱,那么(可能)这是一个坏主意。也许您应该在stats.stackexchange.com 提出更具体的问题(带有数据)
标签: python numpy signal-processing data-manipulation