【问题标题】:What is model in data mining?什么是数据挖掘中的模型?
【发布时间】:2015-11-05 23:13:22
【问题描述】:
  1. 我想知道,数据挖掘中的MODEL是什么?谁能解释一下?

  2. 当我使用 Weka 时,我会获取我的数据,选择方法并通过单击开始按钮生成模型。任何人都可以解释这个模型背后的内容以及模型在我生成它之后是如何工作的。它使用我选择的方法例如对示例进行分类?

请有人解释一下这些事情吗?

【问题讨论】:

    标签: weka data-mining


    【解决方案1】:

    该模型仅描述了在尝试处理新数据时使用的信息。在一个简单的垃圾邮件检测场景中,该算法通过查看带注释的电子邮件来确定哪些词似乎指向垃圾邮件,哪些不是。然后单词列表形成您的模型。

    当您收到新邮件时,您不会将它们与其他真实邮件进行比较,而是会考虑新邮件的字词并检查您的模型(字词列表)是否显示为垃圾邮件。你看,你变得独立于你的训练数据,相反,你有一个知识试图建模整个“垃圾邮件与非垃圾邮件”的现实。

    【讨论】:

      【解决方案2】:

      假设只有以下与音乐相关的变量:吉他独奏(有/没有),突然的音调变化(有/没有),人声(有/没有,男/女),鼓(有/没有,常规/电子)。

      现在,假设您喜欢有吉他独奏、突然的音调变化、有女声和电子鼓的音乐。另一方面,当音乐有吉他独奏、突然的音调变化、没有人声并且有正常的鼓声时,我会欣赏音乐)。

      这些偏好可以被认为是我们享受音乐的模式。

      现在,假设有一首歌有吉他独奏、突然的音调变化、女声和电子鼓。如果我们要判断你是否喜欢这首歌,答案是肯定的,那是 100% 的匹配。但是我呢?嗯,我很欣赏这首歌的 5 个特点中的 3 个,所以我可能会喜欢它。

      我们上面给出的关于是否欣赏这首歌的答案可以看作是机器学习中的classification任务。现在,如果我们必须根据音乐偏好和上述音乐功能对每个人进行分组,我们将成为 clustering 音乐听众,依此类推。

      我们如何为某事建立模型?当然,从数据来看。当您使用 Weka 时,您的 .arff 文件包含您的训练数据,Weka 使用这些数据来了解这些数据所描绘的事物(在我们的示例中,它将了解我们的音乐偏好)。

      学习过程会生成一个模型,用于对新数据进行分类、分组等。例如,如果我们向 Weka 提供我们的音乐偏好并指示它使用贝叶斯分类器学习我们的模型,那么当我们提供它时有了给定歌曲的特征,它就能判断我们是否喜欢这首歌,以及在多大的概率内。

      【讨论】:

        猜你喜欢
        • 2010-11-12
        • 2011-04-13
        • 1970-01-01
        • 2011-02-07
        • 1970-01-01
        • 2021-07-23
        • 1970-01-01
        • 1970-01-01
        • 2016-04-06
        相关资源
        最近更新 更多