【发布时间】:2015-03-14 16:42:57
【问题描述】:
我正在尝试将一个数字列表与另一个列表列表进行比较,以查看其中有多少非常接近。但是,我的每个数据集都可能有不同的长度。
例如,如果我有一个学习时间列表,学生 1 可能有
1 - [ 10.0, 25.0, 15.7, 45.0]
并与其他学生的列表进行比较
2 - [ 9.0, 30.0, 3.0]
3 - [ 26.0, 44.0]
4 - [ 5.0, 70.0, 90.0, 100.0]
5 - [ 9.0, 27.0, 13.7, 42.0, 56.0, 60.0, 75.0]
我希望比较研究 1 与 5 的比较得分很高,因为有 4 次得分都很好,即使学生 5 有额外的时间而学生 1 没有,我希望它得分相当好学生 1 vs 3 因为有些数字非常匹配,即使有些数字不匹配
我刚刚开始学习机器学习,对随机森林只是略知一二。您可以使用它们进行这种类型的比较还是它们必须具有相同的参数?你能推荐一种不同的方法吗?
实际上,我正在寻找的是具有松散参数的集合的交集。我想在python中实现这个
谢谢!
【问题讨论】:
标签: python-2.7 intersection random-forest