基于YOLOv11肺结节检测系统 医学图像诊断识别

本文涉及的产品
RDS DuckDB + QuickBI 企业套餐,8核32GB + QuickBI 专业版
简介: 基于YOLOv11肺结节检测系统 医学图像诊断识别

基于YOLOv11m_GAM_Attention的肺结节检测系统

项目结构

本项目基于Ultralytics官方代码进行改进,目录结构如下:

lung-nodule-detection/
├── app.py                 # Flask应用程序主入口
├── detect.py              # YOLO检测模块
├── best.pt                # 预训练权重文件(基于YOLOv11训练得到)
├── requirements.txt       # 项目依赖文件
├── static/                # 静态资源目录
│   ├── uploads/           # 用户上传图像存储
│   ├── results/           # 检测结果存储
│   ├── images/            # 系统图片资源
│   │   └── yolov11.jpg    # 系统背景图
│   └── fonts/             # 字体文件
│       └── simhei.ttf     # 中文字体文件
└── templates/             # 前端模板
    ├── index.html         # 主界面模板
    └── exit.html          # 退出页面模板

功能特点

本系统具备以下核心功能:

  • 图像上传:支持PNG/JPG/JPEG格式的肺部CT图像
  • 智能检测:采用YOLOv11m_GAM_Attention模型进行肺结节检测
  • 可视化展示
  • 标注目标框、类别和置信度的检测图像
  • 实时检测耗时统计
  • 目标数量统计
  • 数据输出
  • 目标位置坐标(xmin, ymin, xmax, ymax)
  • 目标类别及置信度详情
  • 可导出CSV格式的检测报告

安装与运行

环境部署步骤:

  1. 安装依赖:
pip install -r requirements.txt
  1. 文件准备:
  • 将GAMA_YOLO11m模型权重置于项目根目录
  • 中文字体放入static/fonts/目录
  1. 创建必要目录:
mkdir -p static/uploads static/results static/fonts
  1. 启动服务:
python app.py
  1. 访问系统:
http://localhost:5000

使用说明

  1. 通过主页"选择文件"按钮上传CT图像
  2. 系统自动处理并显示检测结果
  3. 功能操作区:
  • 使用目标选择器切换查看不同检测目标
  • 查看底部详细检测数据表格
  • 点击"保存"导出CSV报告
  • 点击"退出"安全关闭系统

YOLOv11m_GAM_Attention模型

性能对比表:

模型 输入尺寸 mAP50 mAP50-95 参数量(M) FLOPs(B)
YOLOv11m_GAM_Attention 640 0.888 0.587 23.9 80.2
YOLO11m(基准) 640 0.859 0.579 20.0 67.6

模型架构创新:

  1. 注意力机制设计
  • 通道注意力子模块:采用3D排列+双层MLP结构
  • 空间注意力子模块:基于卷积的空间信息融合
  1. 技术优化
  • 避免最大池化操作以减少信息损失
  • 采用分组卷积+通道混洗控制参数增长
  • 在P3/P4/P5特征层均集成GAM模块
  1. 应用效果
  • 专为肺结节检测任务优化
  • 显著提升对小目标的检测灵敏度
  • 较基准模型mAP50提升3.4%
相关文章
|
3小时前
|
人工智能 自然语言处理 文字识别
阿里云百炼Qwen3.7-Max简介:能力、优势、支持订阅计划参考
Qwen3.7-Max是阿里云百炼面向智能体时代推出的新一代旗舰模型,对标GPT-5.5、Claude Opus 4.7等闭源旗舰。该模型支持百万级token上下文窗口,具备顶级推理能力、多模态搜索与视觉理解增强、流式输出低延迟响应等核心优势,覆盖编程、办公、长周期自主执行等复杂场景。同时支持OpenAI接口兼容,便于系统快速迁移。用户可通过Token Plan团队或节省计划等订阅方式灵活调用,适合企业级高要求场景使用。
7194 31
阿里云百炼Qwen3.7-Max简介:能力、优势、支持订阅计划参考
|
3小时前
|
数据采集 人工智能 前端开发
让 Coding Agent 从黑盒到透明:阿里云 Agent 观测审计数据采集实践
AI Agent 规模化落地带来执行黑盒、行为难追溯、成本难度量三大难题。阿里云基于 OTel 标准,面向 Coding Agent、个人通用助理和框架型 Agent,推出 LoongSuite Pilot、插件及探针等无侵入采集方案,让 Agent 实现可看见、可分析、可审计、可治理。
625 140
|
3小时前
|
人工智能 缓存 自然语言处理
阿里Qwen3.7-Max评测:Agent能力显著提升,耗时与调用成本大幅下降
阿里云百炼推出面向智能体的旗舰大模型Qwen3.7-Max,具备长周期自主执行能力,显著提升编程、办公自动化等复杂任务处理水平;支持MCP集成与多框架兼容,并以限时5折+100万Tokens免费试用大幅降低使用门槛,助力企业高效落地AI应用。在阿里云百炼平台快速体验:https://t.aliyun.com/U/fPVHqY
|
3小时前
|
人工智能 弹性计算 运维
阿里云发布堡垒机智能运维Agent,运维交互进入自然语言新时代
支持自然语言运维,提升效率与安全双保障。
1158 1
|
3小时前
|
人工智能 安全 定位技术
CodeGraph深度解析 让Claude Code工具调用直降七成的核心原理与实操教程
如今以Claude Code为代表的AI编程智能体已经成为开发者日常编码、项目重构、漏洞修复的必备工具。但在长期使用过程中,几乎所有开发者都会遇到同一个明显痛点:AI虽然具备强大的代码生成与分析能力,却常常陷入盲目探索的循环中。
1222 2
|
3小时前
|
存储 定位技术 数据库
CodeGraph 如何让 Claude Code减少 7 成工具调用?
CodeGraph 为 Coding Agent 提供本地代码知识图谱,把函数、类、调用链和框架路由提前整理成“项目地图”,减少盲目搜索和文件读取。它不是新 Agent,而是上下文基础设施,让 Agent 更快找到正确代码路径,平均减少 7 成工具调用。
1296 3
|
3小时前
|
人工智能 弹性计算 安全
阿里云618活动时间、活动入口、优惠活动详细解读
2026年阿里云618创新加速季已全面开启,作为年度力度最大的云产品促销活动,本次大促覆盖轻量应用服务器、ECS云服务器、GPU云服务器、数据库、AI算力、安全服务、CDN等全品类产品,推出5亿元算力补贴、新用户限时秒杀、普惠满减、企业专享、免费试用、云大使返佣等多重福利,个人开发者、中小企业、AI团队均可享受专属低价。本文将系统梳理2026年阿里云618活动的完整时间节点、官方参与入口、各类优惠细则、使用规则、热门产品推荐及实操代码,帮助用户精准参与、高效省钱,以最低成本完成上云部署。
1044 5
|
3小时前
|
人工智能 自然语言处理 算法
|
3小时前
|
人工智能 自然语言处理 安全
Vibe Coding 实战:别盲目跟风,先分清 vibe coding 适合什么场景
本文系统总结vibe coding实战经验:明确其适用场景(原型、小工具、标准化模块),剖析5步落地流程(场景判定→结构化提示词→目录初始化→分模块生成→自动化校验),指出四大常见误区,并推荐适配工具Trae。强调“场景匹配+规则前置”是提效关键,避免盲目套用。
857 1
|
3小时前
|
人工智能 运维 API
2026年阿里云百炼通义千问Qwen3.7-plus深度介绍 功能特性、使用优势及618大促订阅方案指南
大模型技术的普及,让AI能力逐步融入个人办公、内容创作、代码编写、企业运营、教育培训等各类场景。不同定位的模型对应不同使用需求,旗舰级模型性能强劲但使用成本偏高,轻量化模型价格低廉却难以胜任复杂任务,而介于两者之间的中端主力模型,凭借均衡的能力、亲民的定价、广泛的场景适配性,成为绝大多数个人用户、小型团队、中小企业的首选。
406 1