如何找到Imagenet数据标签?

J. *_*ark 7 deep-learning tensorflow imagenet

我有两个关于如何加载Imagenet数据的问题.我下载了ILSVRC2012验证集(原因训练集太大了)但我有两个问题.

  1. 我无法理解如何找到标签.只有jpeg文件的文件名如" ILSVRC2012_val_00000001.JPEG",但没有标签.我怎么才能找到它们?

  2. 据我所知,Imagenet使用224*224像素图像,问题只是"分类"而不是"检测",但ILSVRC2012集有更多不同的像素大小.那么,我怎样才能获得224*224像素的正确方框?

dar*_*231 5

它位于开发套件中(任务 1 和 2),文件名为“ILSVRC2012_validation_ground_truth.txt”


Mic*_*lSB 5

  1. 您将下载三个tar归档文件:一个用于训练数据,一个用于验证数据,以及一个用于测试数据。

    培训数据包含在1000个文件夹中,每个班级一个文件夹(每个文件夹应包含1300张JPEG图像)。验证数据是一个包含50k JPEG图像的文件夹,在中查找相应的ILSVRC2012_validation_ground_truth.txt文件(如darren1231所述,它需要作为DevKit的一部分单独下载)。

测试数据类似于验证数据,但没有标签(未向您提供标签,因为您需要在竞争中向其提交预测的标签)。

  1. ImageNet图像的分辨率可变,平均为482x415,这取决于您如何处理它们以训练模型。大多数人的处理方式如下:首先缩小每个图像的尺寸,使其短边为256像素。然后裁剪一个随机的224x224补丁。使用这些补丁进行训练(每个时期您将获得不同的农作物)。在测试过程中,请执行相同的操作,但是提取一个中心224x224补丁,并将其用于评估分类准确性。有些人还使用多个补丁进行测试。同样,这取决于您,并且您可以根据需要使用更高的分辨率。


小智 0

确保从此处下载并将每个文件 .tar 解压到包含synsent每个类编号的文件夹中。这是避免混合图片的最佳方法。