【发布时间】:2021-10-04 09:07:32
【问题描述】:
在过去几天里,我花了大部分时间搜索论坛和阅读论文,试图解决以下问题。我有数千个时间序列数组,每个数组的长度各不相同,包含一个列向量。此列向量包含海豚使用回声定位的点击之间的时间。
我已经设法使用 DTW 将它们聚类到相似的组中,并想检查哪些列车具有高度相似性,即重复模式。我只想知道与他们自己的相似性,并不关心将它们与其他火车进行比较,因为我已经为此申请了 DTW。我希望其中一些集群将包含具有高比例重复模式的火车。
我已经对每个系列应用了 Ljung–Box 测试来检查自相关,但我认为我应该使用 FFT 和功率谱。我在这方面没有太多经验,但尝试使用 Python 包 waipy 来实现。最终,我只想知道在用 p 值进行理想测试的数据中是否存在某种重复模式。我附上的图片显示了顶部的示例火车。我的火车的最大长度是 550。
我知道这是一个相当复杂的问题,但我们将不胜感激任何帮助,即使它是指向有用的 Python 库的链接。
谢谢,
敏捷
【问题讨论】:
-
为什么要“用 p 值测试它们”?
-
我猜它不需要是 p 值。我只是想要一种方法,可以确定是否有一列重复模式的火车,这样我就可以为成千上万的火车自动化。
-
非常有趣的问题,但是,这里不是主题,因为它不是一个特定的编程问题。请改用 stats.stackexchange.com 或 dsp.stackexchange.com。
-
啊,好吧!我现在已经在 stats exchange 上问过了。我认为因为它与python相关,所以在这里问就可以了。我会留下几个小时以防万一我删除它。谢谢:)
标签: python audio statistics time-series fft