您当前的位置: 首页 > 
  • 0浏览

    0关注

    2393博文

    0收益

  • 0浏览

    0点赞

    0打赏

    0留言

私信
关注
热门博文

Dataset之WebVision:WebVision数据集简介、下载、使用方法之详细攻略

一个处女座的程序猿 发布时间:2019-05-22 23:33:45 ,浏览量:0

Dataset之WebVision:WebVision数据集简介、下载、使用方法之详细攻略

 

 

 

目录

WebVision数据集简介

1、WebVision数据集挑战

WebVision数据集下载

WebVision数据集使用方法

 

 

 

 

WebVision数据集简介

        WebVision数据集主要有Google和Flickr两个数据源。主要是利用ImageNet1000个类的文本信息 从网站上爬数据,所以它的数据类别与}mageNet完全一样,为1000类别,由240万幅图片构成训练 数据。比}mageNet的两倍还多,分别由5万张图片构成验证集和测试集(均带有人工标注)。 

1、WebVision数据集挑战

(1)、数据分布不平衡

      WebVision数据集主要有两个挑战。 第一个挑战,数据分布非常不平衡。 如图横坐标代表1000个类别,纵坐标代表每个类别的图片数量。如图浅蓝色的平稳曲线是ImageNet的 数据分布,每一个类别大概有1200张图片。而深蓝色曲线为Web Vision数据分布,可以看出有的类别高达11000张,而最少的小于400张图片,这种极度不平衡的分布对训练模型影响非常大。 

(2)、数据集含有大量错误或歧义的标签

          第二个挑战,数据集含有大量错误或歧义的标签。 数据集中含有大量与类别标签不相关或歧义的图片,也就是所谓的噪声,这也是最主要的一个难点。比如Willet可以是一种鸟,但也可以是人名,也可以是建筑物的名字。

 

WebVision数据集下载

后期更新……

 

 

 

WebVision数据集使用方法

后期更新……

 

 

关注
打赏
1664196048
查看更多评论
立即登录/注册

微信扫码登录

0.0444s