【问题标题】:Training and classifier computer vision [closed]训练和分类计算机视觉 [关闭]
【发布时间】:2014-07-07 17:37:21
【问题描述】:

在计算机视觉中训练数据(图像集)的含义是什么?它是如何完成的? 什么是分类器?

【问题讨论】:

  • 您希望我们为您提供计算机科学和人工智能学位,还是只提供一个 wiki 链接?
  • 可以提供学位吗?

标签: image vision


【解决方案1】:

在机器学习中,您有某种学习算法。学习算法获取一些数据,称为训练集,并从中生成一个世界模型。因此,假设您有一个计算机视觉学习算法,它试图将图像分为两类:一张是人脸图片,或者不是一张人脸图片。

为了简单起见,假设学习算法非常愚蠢 - 你向它输入标有“脸”的面孔图片和没有标有“不是面孔”的面孔的事物的图片。然后,我们的愚蠢算法只计算标记为“人脸”的图片的平均光强度,并生成一个模型,说明“如果图片的平均强度更接近我之前看到的标记为“脸”的图片的平均强度,而不是我之前看到的图片被标记为“不是一张脸”,然后预测我正在显示的图片是一张脸。”

为了计算人脸图像的平均光强度而必须展示的图片以及标记为“不是人脸”的图片是训练集。

训练集与测试集进行对比。如果您之前已经向它展示过那张照片,那么算法生成一个告诉您一张照片是一张脸的模型并不是很令人印象深刻。所以通常当你有数据时,你会“保留”(或留出)一小部分来评估模型的实际效果。

机器学习任务的基本过程分解如下:

  1. 获取、准备和格式化数据,以便将其用作模型的输入。
  2. 通过随机选择,留出一部分数据作为“训练集”,另一部分作为“测试集”。通常留出 10% 左右用于测试。
  3. 将学习算法应用于训练集。
  4. 学习算法的输出是一个模型,它接受输入并在给定输入的情况下产生一些输出。在计算机视觉环境中,输入几乎总是一张图片,但输出可能是一个分类,也许是一张 3D 地图,也许它会在图片中找到某些东西;这取决于您要做什么。
  5. 通过向模型提供以前从未见过的数据(即测试集)来确定模型的准确性,并将模型的输出与您知道的输出进行比较。

【讨论】:

    【解决方案2】:

    您使用训练数据来构建分类器。

    具体是怎么做的?它因人而异。简而言之,您需要某种距离度量(一个简单的规则)来比较您的样本。你还需要一个规则来做出决定,比如说决定这个对象是属于 A 类还是 B 类。

    诀窍是找到这样的距离度量,它非常简单,但在不同类别的图像中变化很大。为了做出决策,您可以依靠信息论并选择任何可用的技术,例如:svm、rf。

    【讨论】:

    • 一种看待它的方式
    猜你喜欢
    • 2020-09-16
    • 1970-01-01
    • 2011-07-25
    • 2013-08-20
    • 2012-04-02
    • 2018-03-19
    • 1970-01-01
    • 2011-02-14
    • 1970-01-01
    相关资源
    最近更新 更多