【问题标题】:Meaning of samples in Libsvm dataset format (Mnist in particular)Libsvm 数据集格式(特别是 Mnist)中样本的含义
【发布时间】:2011-11-19 19:30:22
【问题描述】:

我从Libsvm's dataset page 下载了 Mnist 数据集。 所有样本如下:

5 153:3 154:18 155:18 156:18 157:126 ...

有人知道这是什么意思吗? 5 是类标签,但例如 153:3 对是什么?我也找不到mnist's own web page的意思。

【问题讨论】:

    标签: dataset machine-learning libsvm


    【解决方案1】:

    这是libsvm 编码(稀疏)向量的方式。正如你所说的5 是标签,下面的对i:v 说向量的i-th 条目是v。因此,您可以将 3 维向量 (a,b,c) 编码为

    1:a 2:b 3:c
    

    这对于密集向量来说效率低下,但对于稀疏数据来说是一种良好且成熟的格式。由于它是纯文本,存储空间不是最佳的,但对于大多数应用程序来说已经足够了。而文件易于编写和阅读。

    【讨论】:

      猜你喜欢
      • 2016-09-28
      • 2017-02-14
      • 2014-07-31
      • 1970-01-01
      • 2019-09-07
      • 2018-04-10
      • 2017-11-30
      • 1970-01-01
      • 2017-08-07
      相关资源
      最近更新 更多