医疗废物检测数据集 | 7600张YOLO医疗垃圾分类数据集

简介: 本数据集含7600张YOLO格式标注图像,覆盖9类医疗废物(如带血棉签、注射器、药瓶等),涵盖感染性、损伤性、药物性三大类别。真实场景采集、高质量人工标注,适配YOLOv5/v8/v10等模型,助力医废智能分拣、院感防控与安全管理。

医疗废物检测数据集 | 7600张YOLO医疗垃圾分类数据集

适用于医疗废物分拣、院感防控与目标检测研究


一、数据集概述

本数据集面向医疗废物智能分类与安全管理场景,共包含约7600张高质量标注图像,覆盖9类常见医疗废物,涵盖感染性废物、损伤性废物及药物性废物等主要类别。该数据集旨在支持 深度学习 目标检测模型的训练、验证与测试,可广泛应用于医废分拣、院感防控、智能回收等场景下的医疗废物自动识别与分类,适用于YOLO系列等主流目标检测 算法 的训练、验证与测试。

随着医疗废物管理要求的日益严格和环保意识的持续提升,利用计算机 视觉 技术实现医疗废物的自动识别与分类已成为推动医疗废物规范化管理、降低院感风险、提高处理效率的重要手段。本数据集针对医疗废物检测场景中类别多样、形态各异、混杂堆叠等问题进行专项构建,可为医疗废物智能分拣系统与院感防控体系提供高质量数据支撑。

在这里插入图片描述

数据集下载

链接:https://pan.baidu.com/s/1da7FVhHa8iRwHGddiySyTg?pwd=w81x

提取码:w81x 复制这段内容后打开百度网盘手机App,操作更方便哦

二、数据集基本信息

项目 内容
数据集名称 医疗废物检测数据集
数据规模 约7600张高质量标注图像
任务类型 目标检测(Object Detection)
检测目标 9类常见医疗废物
类别数量(nc) 9类
标注方式 Bounding Box目标框标注
数据格式 YOLO标准格式
数据来源 真实医疗机构与医废处理场景采集
数据划分 Train / Valid / Test
适配模型 YOLOv5、YOLOv8、YOLOv10、YOLOv11、Faster R-CNN等

三、数据集类别说明

本数据集为多类别目标检测数据集,共设置9个检测类别,涵盖感染性废物、损伤性废物及药物性废物等主要医疗废物类别,贴合医疗废物五分类管理要求。

在这里插入图片描述

类别配置

nc: 9

names:
  - bloody_cotton_swab
  - glucose_infusion_bottle
  - infusion_needle
  - infusion_bag
  - medicine_bottle
  - metal_sharp
  - plastic_bag
  - syringe
  - small_medicine_bottle

类别详情

类别ID 类别名称 英文名称 废物分类 类别说明
0 带血棉签 bloody_cotton_swab 感染性废物 沾染血液的棉签、棉球等
1 葡萄糖输液瓶 glucose_infusion_bottle 药物性废物 葡萄糖输液用玻璃/塑料瓶
2 输液针 infusion_needle 损伤性废物 输液器配套的针头
3 输液袋 infusion_bag 药物性废物 输液用软袋包装
4 药瓶 medicine_bottle 药物性废物 药品包装瓶
5 金属锐器 metal_sharp 损伤性废物 手术刀片、缝合针等金属锐器
6 塑料袋 plastic_bag 药物性/其他废物 医疗用塑料包装袋
7 注射器 syringe 损伤性废物 带针或不带针的注射器
8 小药瓶 small_medicine_bottle 药物性废物 小型药品包装瓶(如安瓿瓶、西林瓶等)

9类设计全面覆盖了医疗废物的主要来源类别,包含感染性废物(带血棉签)、损伤性废物(金属锐器、注射器、输液针)及药物性废物(药瓶、小药瓶、葡萄糖输液瓶、输液袋、塑料袋)等,能够满足医疗废物智能识别与分类的业务需求。

四、数据集结构说明

数据集采用标准YOLO目录结构组织,已按训练集、验证集、测试集进行科学划分,每个图像对应一个同名的.txt标注文件,含数据集元信息文件,可直接导入各类目标检测 框架 。

database/
└── 医疗废物检测数据集
    ├── train
    │   └── images
    ├── valid
    │   └── images
    └── test
        └── images

各数据集作用如下:

  • train/images:训练集图像,用于模型参数学习与特征提取;
  • valid/images:验证集图像,用于超参数调优、早停监控及防止过拟合;
  • test/images:测试集图像,用于最终模型性能评估与泛化能力测试。

标注文件为同名.txt格式,每行格式为类别索引 x_center y_center width height,坐标均为归一化值,可直接适配YOLO系列等目标检测框架。

在这里插入图片描述

五、数据集核心优势

1. 真实医疗与医废处理场景采集

数据全部来源于真实医疗机构与医废处理场景,真实反映医疗废物检测实际应用场景,具有高度的工程实用价值。

覆盖场景包括:

  • 医院临床科室与病房
  • 门诊治疗室与处置室
  • 医废暂存点与转运通道
  • 医废集中处理中心
  • 不同规模医疗机构

能够有效提升模型的实际部署效果。

2. 全面的医疗废物类别覆盖

9类医疗废物覆盖三大主要废物类别,贴合国家医疗废物分类管理要求:

  • 感染性废物:带血棉签——感染性风险最高的医疗废物之一
  • 损伤性废物:金属锐器、注射器、输液针——具有刺伤风险的高危废物
  • 药物性废物:药瓶、小药瓶、葡萄糖输液瓶、输液袋、塑料袋——药物残留与包装废物

覆盖医疗废物的主要风险类别,为医废全过程管理提供视觉识别基础。

3. 多样化的目标形态覆盖

不同医疗废物在形态、大小、颜色、材质上存在显著差异:

  • 棉签类:细小长条形,白色带血迹
  • 瓶类:小型、中型玻璃/塑料瓶
  • 袋类:软质透明/半透明包装
  • 锐器类:小型金属锐利器具
  • 输液器材:带管路、带针头的组合器具
  • 注射器:带刻度圆柱形器具

有助于提升模型对多样化医疗废物形态的检测与泛化能力。

4. 复杂的实际场景条件

数据覆盖:

  • 不同光照条件(室内灯光、自然光、阴影区域)
  • 不同拍摄角度与距离
  • 医疗废物混合堆放场景
  • 不同盛装容器内(利器盒、黄色医废袋等)
  • 不同背景(治疗台、医废桶、转运车等)

能够有效增强模型在真实医疗环境中的鲁棒性。

5. 高质量人工标注

所有图像均经过严格筛选与精细化标注:

  • 标注框精准贴合医疗废物目标轮廓
  • 9类废物判别标准统一清晰
  • 混合堆放场景下的独立标注处理
  • 无漏标现象
  • 无类别混淆

有效保证 模型训练 质量。

6. 大规模即用型数据

7600张图像规模,已按train/valid/test划分,采用标准 YOLO格式 组织,无需二次整理即可直接导入各类目标检测框架,快速投入模型训练、调优与评估。

7. 适配轻量化与高 精度 模型

数据规模大、类别丰富,适配轻量化工业部署模型与高精度科研模型训练,适用于医废智能分拣系统开发、院感防控项目建设及医疗机构数字化转型等场景。

在这里插入图片描述

六、适用场景

医疗废物智能分拣系统

为医疗废物自动分拣设备提供视觉识别能力,实现医疗废物的自动分类与安全处理。

院感防控与安全管理

在临床科室和医废处理环节自动识别感染性废物与损伤性废物,降低职业暴露风险。

医废智能回收管理

基于识别结果实现医废分类回收的智能化管理,实现医废全流程可追溯。

医疗机构废弃物监管

为卫生健康管理部门提供医疗废物的自动识别与分类统计能力,支撑监管决策。

医废无害化处理

在集中处置中心实现医废自动识别与分类,提高无害化处理效率与安全性。

医疗机构数字化升级

作为智慧医院后勤管理系统的核心感知模块,推动医疗机构废弃物管理的数字化转型。

七、适用研究方向

本数据集可广泛应用于以下研究领域:

  • 医疗废物自动识别与分类研究(9类)
  • 多类别目标检测研究
  • 感染性/损伤性/药物性废物分类研究
  • 复杂场景目标检测研究
  • YOLO系列模型优化研究
  • 轻量化检测模型与边缘部署研究
  • 医院感染防控与职业安全研究
  • 医疗废弃物管理研究
  • 域适应与跨场景泛化研究
  • 数据增强与类别不平衡研究

八、总结

医疗废物检测数据集包含约7600张高质量标注图像,采用标准YOLO格式构建,专注于医疗废物的检测与分类任务。数据集覆盖带血棉签、葡萄糖输液瓶、输液针、输液袋、药瓶、金属锐器、塑料袋、注射器、小药瓶9类核心医疗废物类别,涵盖感染性、损伤性、药物性三大废物类型,具有类别全面、场景真实、标注精准等特点,可广泛应用于医废分拣、院感防控、智能回收管理等领域,是开展医疗废物智能识别算法研发与医疗安全管理系统的优质数据资源。

相关文章
|
4天前
|
云安全 人工智能 运维
阿里云联动百位企业安全专家,共识Agent防御最佳实践
当Agent成为新员工,你的安全边界在哪里?
1734 2
阿里云联动百位企业安全专家,共识Agent防御最佳实践
|
12天前
|
人工智能 JSON 安全
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
阿里云AI安全产品联动防御Fastjson攻击
2448 13
Fastjson远程代码执行漏洞,阿里云AI安全为您保驾护航
|
12天前
|
人工智能 自然语言处理 数据挖掘
Qwen3.8-Max-Preview深度全解析:2.4万亿参数旗舰MoE模型+Token Plan限时优惠完整落地指南
2026年7月,全新旗舰级混合专家大模型Qwen3.8-Max-Preview正式开放抢先体验,作为通义千问Qwen3系列规格最高、综合推理能力顶尖的新一代模型,该模型总参数量达到2.4万亿(2.4T),是当前线上可调用的原生多模态旗舰模型,综合推理水准对标海外顶级Fable 5模型,在复杂工程开发、长文档深度分析、多步骤智能体自治、跨境多语言创作、海量数据挖掘五大高难度业务场景实现跨越式性能提升。
1182 2
|
10天前
|
人工智能 前端开发 Linux
Codex 桌面版安装 + CC Switch 接入第三方 API 完整教程(2026 最新)
2026最新教程:手把手教你安装Codex桌面版,通过CC Switch v3.17.0一键接入Fenno等国产API(兼容OpenAI Responses格式),跳过账号登录,完整启用代码审查、多步任务与上下文感知功能。零基础友好,全程图文实操。(239字)
977 2
|
14天前
|
人工智能
Qwen3.8抢先体验!正式版即将发布并开源!
千问Qwen3.8即将开源,参数达2.4T,进化速度以“天”计,实力媲美Fable 5。预览版Qwen3.8-Max已上线阿里Token Plan等平台,限时优惠:日间Credits低至1折,夜间更优,个人/团队版月付仅35元起!
1187 49
|
10天前
|
自然语言处理 测试技术 API
通义千问Qwen3.8-Max-Preview全功能解析:2.4万亿参数旗舰模型深度使用指南
在大模型技术持续迭代的当下,通义千问推出的Qwen3.8-Max-Preview作为新一代旗舰预览版模型,凭借2.4万亿参数的超大规模、多模态融合能力与全场景适配特性,成为开发者与企业用户探索AI应用的核心工具。该模型采用稀疏混合专家(MoE)架构,是通义千问首个突破万亿参数的多模态模型,可同时处理文本、图像、视频与文档等多种数据形态,在全栈代码开发、复杂逻辑推理、长文档分析与多智能体协作等场景实现跨越式升级。本文将全面拆解Qwen3.8-Max-Preview的核心功能,详解API调用流程与配置方法,覆盖多场景实战技巧,帮助用户快速掌握这款旗舰模型的使用方法,充分释放其性能潜力。
604 2
|
11天前
|
SQL 关系型数据库 MySQL
【2026最新】DBeaver下载、安装、数据库管理一篇搞定(附官网社区版安装包)
DBeaver是一款免费开源的跨平台通用数据库管理工具,支持MySQL、PostgreSQL、SQLite、Oracle等几乎所有主流数据库,无需为每种数据库安装独立客户端,极大提升开发与数据分析效率。

热门文章

最新文章