深度学习常用数据集介绍与下载(附网盘链接)

简介: 深度学习常用数据集介绍与下载(附网盘链接)

1. 分类数据集


数据集:MNIST



       手写数字数据集,包含一组60,000个示例的训练集和一组10,000个示例的测试集。

       官网地址:MNIST handwritten digit database, Yann LeCun, Corinna Cortes and Chris Burges

       关键字(建议复制):Face-Place


数据集:CIFAR-10



       包含了10个类别的60,000个图像(每个类在上图中表示为一行)。总共有50,000个训练图像和10,000个测试图像。

       官网地址:CIFAR-10 and CIFAR-100 datasets

       关键字(建议复制):CIFAR-10


数据集:Fashion-MNIST



       包含60,000个训练图像和10,000个测试图像。类似MNIST的时尚产品数据库。

       官网地址:GitHub - zalandoresearch/fashion-mnist: A MNIST-like fashion product database. Benchmark

       关键字(建议复制):fashion-mnist


数据集:Imagenet



       Imagenet数据集有1400多万幅图片,涵盖2万多个类别,关于图像分类、定位、检测等研究工作大多基于此数据集展开。

       官网地址:http://www.image-net.org/about-stats

       关键字(建议复制):ImageNet


2. 目标检测数据集


数据集:MS-COCO



       COCO是一个规模大且丰富的物体检测,分割和字幕数据集。330K图像,80个物体类别,每幅图像5个字幕,250,000个有关键点的人。

       官网地址:COCO - Common Objects in Context

       关键字(建议复制):MS-COCO


数据集:PASCAL-VOC



       PASCAL VOC挑战赛是视觉对象的分类识别和检测的一个基准测试,提供了检测算法和学习性能的标准图像注释数据集和标准的评估系统,包括20个目录。

       官网地址:The PASCAL Visual Object Classes Homepage

       关键字(建议复制):PASCAL-VOC


数据集:BDD100K



       自动驾驶常用大型多样化数据集,标注超过100,000张图像,类别包含公共汽车,行人,自行车,卡车,小汽车,火车和骑手等,用于目标检测、全帧分割等。

       官网地址:Berkeley DeepDrive

       关键字(建议复制):BDD-100K


数据集:Open-Images



       Open Images是一个包含近900万个图像URL的数据集。这些图像已经用数千个类别的图像级标签边框进行了注释。

       官网地址:Open Images V6

       关键字(建议复制):Open-Images


3. 人脸识别数据集


数据集:CASIA-WebFace



       包含了10575 个人的494414 张图像。CASIA-webface数据库,里面包含了10000个人,一共50万张人脸图片,均来源于网络。

       官网地址:NameBright - Coming Soon

       关键字(建议复制):CASIA-WebFace


数据集:PubFig



       哥伦比亚大学的公众人物脸部数据集,包含有200个人的58k+人脸图像,主要用于非限制场景下的人脸识别。

       官网地址:Pubfig: Public Figures Face Database

       关键字(建议复制):PubFig


数据集:CelebA



       香港中文大学汤晓鸥教授实验室公布的大型人脸识别数据集。该数据集包含有200K张人脸图片,人脸属性有40多种,主要用于人脸属性的识别。

       官网地址:CelebA Dataset

       关键字(建议复制):CelebA


数据集:ColorFeret



       包括了一个通用人脸库以及通用测试标准,它已经包含了1000多人的10000多张照片,每个人包括了不同表情,光照,姿态和年龄的照片。

       官网地址:color FERET Database | NIST

       关键字(建议复制):ColorFeret


数据集:MTFL



       该数据集包含了将近13000张人脸图片,均采自网络。

       官网地址:Facial Landmark Detection by Deep Multi-task Learning

       关键字(建议复制):MTFL


数据集:FaceDB



       包含了1521幅分辨率为384x286像素的灰度图像。每一幅图像来自于23个不同的测试人员的正面角度的人脸。

       官网地址:BioID Face Database | Face Detection Dataset | facedb - BioID

       关键字(建议复制):FaceDB


数据集:LFW



       为了研究非限制环境下的人脸识别问题而建立的。这个数据集包含超过13,000张人脸图像,均采集于Internet。为了研究非限制环境下的人脸识别问题而建立的。这个数据集包含超过13,000张人脸图像,均采集于Internet。

       官网地址:http://vis-www.cs.umass.edu/lfw/

       关键字(建议复制):LFW


数据集:Person identification in TV series



       该数据集所选用的人脸照片均来自于两部比较知名的电视剧,《吸血鬼猎人巴菲》和《生活大爆炸》。

       官网地址:Semi-supervised Learning with Constraints for Person Identification in Multimedia Data

       关键字(建议复制):PITVS


数据集:CMUVASC-PIE



       CMU PIE人脸库建立于2000年11月,它包括来自68个人的40000张照片,其中包括了每个人的13种姿态条件,43种光照条件和4种表情下的照片。

       官网地址:http://vasc.ri.cmu.edu/idb/html/face/index.html

       关键字(建议复制):CMUVASC-PIE


数据集:CASIA-FaceV5



       该数据集包含了来自500个人的2500张亚洲人脸图片。

       官网地址:http://biometrics.idealtest.org/dbDetailForUser.do?id=9

       关键字(建议复制):CASIA-FaceV5


数据集:The CNBC Face Database



       该数据集采集了200个人在不同状态下(不同的神情,装扮,发型等)的人脸照片。

       官网地址:http://wiki.cnbc.cmu.edu/Face_Place

       关键字(建议复制):Face-Place


数据集:IMDB-WIKI



       IMDB-WIKI人脸数据库总共523,051张人脸数据库,每张图片都被标注了人的年龄和性别,对于年龄识别和性别识别的研究有着重要的意义。

       官网地址:IMDB-WIKI - 500k+ face images with age and gender labels

       关键字(建议复制):IMDB-WIKI


数据集:FDDB



       FDDB是UMass的数据集,被用来做人脸检测(Face Detection)。这个数据集比较大,比较有挑战性。

       官网地址:http://vis-www.cs.umass.edu/fddb/index.html

       关键字(建议复制):FDDB


数据集:Caltech-10K-WebFaces



       10k+人脸,提供双眼和嘴巴的坐标位置。

       官网地址:ttp://www.vision.caltech.edu/Image_Datasets/Caltech_10K_WebFaces/#Description

       关键字(建议复制):Caltech-10K


数据集:JAFFE



       该数据库是由10位日本女性在实验环境下根据指示做出各种表情。整个数据库一共有213张图像,10个人,全部都是女性,每个人做出7种表情。

       官网地址:The Japanese Female Facial Expression (JAFFE) Dataset | Zenodo

       关键字(建议复制):JAFFE


数据集:AFLW



       前2000个AFLW样本的拟合3D面,可用于3D面对齐评估。

       官网地址:http://www.cbsr.ia.ac.cn/users/xiangyuzhu/projects/3DDFA/main.htm

       关键字(建议复制):AFLW

相关文章
|
机器学习/深度学习 编解码 人工智能
人脸表情[七种表情]数据集(15500张图片已划分、已标注)|适用于YOLO系列深度学习分类检测任务【数据集分享】
本数据集包含15,500张已划分、已标注的人脸表情图像,覆盖惊讶、恐惧、厌恶、高兴、悲伤、愤怒和中性七类表情,适用于YOLO系列等深度学习模型的分类与检测任务。数据集结构清晰,分为训练集与测试集,支持多种标注格式转换,适用于人机交互、心理健康、驾驶监测等多个领域。
|
12月前
|
机器学习/深度学习 传感器 人工智能
火灾火焰识别数据集(2200张图片已划分、已标注)|适用于YOLO系列深度学习分类检测任务【数据集分享】
在人工智能和计算机视觉的快速发展中,火灾检测与火焰识别逐渐成为智慧城市、公共安全和智能监控的重要研究方向。一个高质量的数据集往往是推动相关研究的核心基础。本文将详细介绍一个火灾火焰识别数据集,该数据集共包含 2200 张图片,并已按照 训练集(train)、验证集(val)、测试集(test) 划分,同时配有对应的标注文件,方便研究者快速上手模型训练与评估。
4521 10
火灾火焰识别数据集(2200张图片已划分、已标注)|适用于YOLO系列深度学习分类检测任务【数据集分享】
|
12月前
|
机器学习/深度学习 人工智能 监控
河道塑料瓶识别标准数据集 | 科研与项目必备(图片已划分、已标注)| 适用于YOLO系列深度学习分类检测任务【数据集分享】
随着城市化进程加快和塑料制品使用量增加,河道中的塑料垃圾问题日益严重。塑料瓶作为河道漂浮垃圾的主要类型,不仅破坏水体景观,还威胁水生生态系统的健康。传统的人工巡查方式效率低、成本高,难以满足实时监控与治理的需求。
|
12月前
|
机器学习/深度学习 人工智能 监控
坐姿标准好坏姿态数据集(图片已划分、已标注)|适用于YOLO系列深度学习分类检测任务【数据集分享】
坐姿标准好坏姿态数据集的发布,填补了计算机视觉领域在“细分健康行为识别”上的空白。它不仅具有研究价值,更在实际应用层面具备广阔前景。从青少年的健康教育,到办公室的智能提醒,再到驾驶员的安全监控和康复训练,本数据集都能发挥巨大的作用。
坐姿标准好坏姿态数据集(图片已划分、已标注)|适用于YOLO系列深度学习分类检测任务【数据集分享】
|
12月前
|
机器学习/深度学习 数据采集 算法
PCB电路板缺陷检测数据集(近千张图片已划分、已标注)| 适用于YOLO系列深度学习检测任务【数据集分享】
在现代电子制造中,印刷电路板(PCB)是几乎所有电子设备的核心组成部分。随着PCB设计复杂度不断增加,人工检测PCB缺陷不仅效率低,而且容易漏检或误判。因此,利用计算机视觉和深度学习技术对PCB缺陷进行自动检测成为行业发展的必然趋势。
PCB电路板缺陷检测数据集(近千张图片已划分、已标注)| 适用于YOLO系列深度学习检测任务【数据集分享】
|
12月前
|
机器学习/深度学习 自动驾驶 算法
道路表面缺陷数据集(裂缝/井盖/坑洼)(6000张图片已划分、已标注)|适用于YOLO系列深度学习分类检测任务【数据集分享】
随着城市化与交通运输业的快速发展,道路基础设施的健康状况直接关系到出行安全与城市运行效率。长期高强度的使用、气候变化以及施工质量差异,都会导致道路表面出现裂缝、坑洼、井盖下沉及修补不良等缺陷。这些问题不仅影响驾驶舒适度,还可能引发交通事故,增加道路养护成本。
道路表面缺陷数据集(裂缝/井盖/坑洼)(6000张图片已划分、已标注)|适用于YOLO系列深度学习分类检测任务【数据集分享】
|
机器学习/深度学习 人工智能 监控
单车、共享单车已标注数据集(图片已划分、已标注)|适用于深度学习检测任务【数据集分享】
数据是人工智能的“燃料”。一个高质量、标注精准的单车与共享单车数据集,不仅能够推动学术研究的进步,还能为智慧交通、智慧城市的建设提供有力支撑。 在计算机视觉领域,研究者们常常会遇到“数据鸿沟”问题:公开数据集与真实业务需求之间存在不匹配。本次分享的数据集正是为了弥补这一不足,使得研究人员与工程师能够快速切入单车检测领域,加速模型从实验室走向真实应用场景。
|
机器学习/深度学习 存储 监控
基于深度学习YOLO框架的城市道路损伤检测与评估项目系统【附完整源码+数据集】
本项目基于深度学习的YOLO框架,成功实现了城市道路损伤的自动检测与评估。通过YOLOv8模型,我们能够高效地识别和分类路面裂缝、井盖移位、坑洼路面等常见的道路损伤类型。系统的核心优势在于其高效性和实时性,能够实时监控城市道路,自动标注损伤类型,并生成损伤评估报告。
678 0
基于深度学习YOLO框架的城市道路损伤检测与评估项目系统【附完整源码+数据集】
|
机器学习/深度学习 自动驾驶 算法
基于深度学习的YOLO框架的7种交通场景识别项目系统【附完整源码+数据集】
在智慧交通和智能驾驶日益普及的今天,准确识别复杂交通场景中的关键元素已成为自动驾驶系统的核心能力之一。传统的图像处理技术难以适应高动态、复杂天气、多目标密集的交通环境,而基于深度学习的目标检测算法,尤其是YOLO(You Only Look Once)系列,因其检测速度快、精度高、可部署性强等特点,在交通场景识别中占据了重要地位。
1289 0
基于深度学习的YOLO框架的7种交通场景识别项目系统【附完整源码+数据集】