【发布时间】:2019-03-12 07:57:31
【问题描述】:
我有很多行整数,每行有 7 列,这是从实验中记录的一些生物学点。这些数字仅从 1 到 7,我想确定这些整数出现的常见模式。
first few rows of df:
[,1] [,2] [,3] [,4] [,5] [,6] [,7]
[1,] 1 2 3 4 6 7 7
[2,] 1 2 2 3 3 5 7
[3,] 1 2 2 3 3 4 5
[4,] 2 3 4 7 7 7 7
[5,] 1 1 3 4 5 6 7
[6,] 2 2 3 3 4 6 6
[7,] 1 1 2 3 3 6 6
[8,] 2 2 3 4 6 6 7
...
例如,
desired output:
pattern freq
1 2 3 4 1
2 3 4 6 2
1 2 3 4
2 2 3 4
...
...
请指教,谢谢。
【问题讨论】:
-
我删除了包推荐。我的意思是,这种模式就像数字 1、2、3 一样一起出现的频率,它们在上面的行中一起出现了 4 次。
-
如果你有一行
2 2 2 2 2 2 2,那会算作2 2 2的多少个实例? -
您的示例显示长度为 4 的序列,您的评论建议长度为 3 的序列 ...
-
到目前为止我还没有这个数据,但在这种情况下,我会算作 1
-
是不是长度为4的序列模式更少,更容易找到频率?如果是这样,我更喜欢长度为 4 更好。
标签: r pattern-matching frequency frequency-analysis frequency-distribution