【发布时间】:2014-07-07 17:37:21
【问题描述】:
在计算机视觉中训练数据(图像集)的含义是什么?它是如何完成的? 什么是分类器?
【问题讨论】:
-
您希望我们为您提供计算机科学和人工智能学位,还是只提供一个 wiki 链接?
-
可以提供学位吗?
在计算机视觉中训练数据(图像集)的含义是什么?它是如何完成的? 什么是分类器?
【问题讨论】:
在机器学习中,您有某种学习算法。学习算法获取一些数据,称为训练集,并从中生成一个世界模型。因此,假设您有一个计算机视觉学习算法,它试图将图像分为两类:一张是人脸图片,或者不是一张人脸图片。
为了简单起见,假设学习算法非常愚蠢 - 你向它输入标有“脸”的面孔图片和没有标有“不是面孔”的面孔的事物的图片。然后,我们的愚蠢算法只计算标记为“人脸”的图片的平均光强度,并生成一个模型,说明“如果图片的平均强度更接近我之前看到的标记为“脸”的图片的平均强度,而不是我之前看到的图片被标记为“不是一张脸”,然后预测我正在显示的图片是一张脸。”
为了计算人脸图像的平均光强度而必须展示的图片以及标记为“不是人脸”的图片是训练集。
训练集与测试集进行对比。如果您之前已经向它展示过那张照片,那么算法生成一个告诉您一张照片是一张脸的模型并不是很令人印象深刻。所以通常当你有数据时,你会“保留”(或留出)一小部分来评估模型的实际效果。
机器学习任务的基本过程分解如下:
【讨论】:
您使用训练数据来构建分类器。
具体是怎么做的?它因人而异。简而言之,您需要某种距离度量(一个简单的规则)来比较您的样本。你还需要一个规则来做出决定,比如说决定这个对象是属于 A 类还是 B 类。
诀窍是找到这样的距离度量,它非常简单,但在不同类别的图像中变化很大。为了做出决策,您可以依靠信息论并选择任何可用的技术,例如:svm、rf。
【讨论】: