【发布时间】:2011-11-19 19:30:22
【问题描述】:
我从Libsvm's dataset page 下载了 Mnist 数据集。 所有样本如下:
5 153:3 154:18 155:18 156:18 157:126 ...
有人知道这是什么意思吗? 5 是类标签,但例如 153:3 对是什么?我也找不到mnist's own web page的意思。
【问题讨论】:
标签: dataset machine-learning libsvm
我从Libsvm's dataset page 下载了 Mnist 数据集。 所有样本如下:
5 153:3 154:18 155:18 156:18 157:126 ...
有人知道这是什么意思吗? 5 是类标签,但例如 153:3 对是什么?我也找不到mnist's own web page的意思。
【问题讨论】:
标签: dataset machine-learning libsvm
这是libsvm 编码(稀疏)向量的方式。正如你所说的5 是标签,下面的对i:v 说向量的i-th 条目是v。因此,您可以将 3 维向量 (a,b,c) 编码为
1:a 2:b 3:c
这对于密集向量来说效率低下,但对于稀疏数据来说是一种良好且成熟的格式。由于它是纯文本,存储空间不是最佳的,但对于大多数应用程序来说已经足够了。而文件易于编写和阅读。
【讨论】: