【发布时间】:2014-07-11 17:07:53
【问题描述】:
我正在尝试实现DBSCAN,但我无法理解其背后的想法。如果它一个一个地遍历整个数据并为近邻创建一个新集群,那么我总是会得到很多集群。假设它检查第一个点的近邻,找到足够的邻居(>MinPts),为他们创建一个集群,移动到下一个点,检查邻居(也可能找到已经在集群中的邻居)并创建一个新的为他们集群。等等。所以一些点将被添加到超过 1 个集群中......因此会创建很多集群。
有人能解释一下这个算法是如何工作的吗?我在网上没有找到太多关于它的信息。
【问题讨论】:
-
密切关注维基百科的伪代码。一个集群可能包含多个核心点。一个集群由所有密度连接点组成,而不仅仅是那些从一开始就可以直接密度到达的点。
标签: algorithm cluster-analysis dbscan