【发布时间】:2017-05-17 17:41:34
【问题描述】:
我有一个国家的数据,其中包含一些数字和名义属性
它们是公司名称、员工人数、销售额、公司类型。
我想弄清楚哪种类型的公司的销售额更高,以及员工人数是否会影响公司的销售额。
由于没有确定的水平,而且我是机器学习的新手,我没有信心,我认为它是无监督学习,需要聚类,但无法弄清楚入门的方法。 感谢你的帮助。 谢谢
【问题讨论】:
标签: machine-learning data-mining data-science bigdata
我有一个国家的数据,其中包含一些数字和名义属性
它们是公司名称、员工人数、销售额、公司类型。
我想弄清楚哪种类型的公司的销售额更高,以及员工人数是否会影响公司的销售额。
由于没有确定的水平,而且我是机器学习的新手,我没有信心,我认为它是无监督学习,需要聚类,但无法弄清楚入门的方法。 感谢你的帮助。 谢谢
【问题讨论】:
标签: machine-learning data-mining data-science bigdata
因为你有一个目标变量,所以不要使用聚类。
改为使用回归。
【讨论】: