基于深度学习和YOLOv11的错题自动切分系统

简介: 基于深度学习和YOLOv11的错题自动切分系统

基于DyHead和YOLOv11的错题自动切分系统

项目简介

集成动态头部检测与YOLOv11的智能错题识别系统,具备:

  • DyHead检测器:高精度题目区域分割
  • YOLOv11模型:5类错误符号识别(✕、/、✓̷、?、○)
  • 智能匹配引擎:支持中心点包含/重叠面积/IOU/距离四重匹配策略

核心技术

双模型协同架构

模块 技术方案 精度指标
题目分割 DyHead+Swim-Transformer mAP@0.5: 98.2%
错符检测 YOLOv11-640 F1-score: 96.5%

四级匹配策略

  1. 中心点包含(优先级最高)
  2. 重叠面积占比 >30%
  3. IOU相似度 >0.25
  4. 欧氏距离 <50px(兜底方案)

快速部署

环境配置

# 安装PyTorch+CUDA11.8  
pip install torch==2.4.1 torchvision==0.19.1 --index-url https://download.pytorch.org/whl/cu118  
# 安装项目依赖  
pip install -e detectron2 ultralytics flask pillow==9.5.0

模型部署

  1. 下载预训练模型:
  • DyHead权重:[cut_question.pth](提取码r5ht)
  • YOLOv11权重:[best.pt](提取码r5ht)
  1. 放置路径:
./configs/dyhead_swint_atss_fpn_2x_ms.yaml  
./yolo_ckps/best.pt

启动服务

python flask_error_detection.py  # 访问 http://localhost:5004

API接口文档

错题检测接口

Endpoint: POST /detect

请求示例

curl -X POST http://localhost:5004/detect -F "image=@test.jpg"

响应示例

{
  "success": true,
  "data": {
    "error_count": 3,
    "questions": [
      {
        "bbox": [100,50,200,150],
        "errors": [
          {
            "type": "cuo",
            "confidence": 0.92,
            "match_method": "中心点包含"
          }
        ]
      }
    ],
    "visualization": {
      "errors_img": "base64...",
      "matches_img": "base64..." 
    }
  }
}

系统架构

Cut/  
├── core/  
│   ├── dyhead_detector.py  # 题目区域分割  
│   └── yolo_detector.py    # 错符检测  
├── utils/  
│   ├── matcher.py          # 四级匹配算法  
│   └── visualization.py   # 结果可视化  
└── web/  
    ├── static/             # 前端资源  
    └── templates/          # HTML页面

效果演示

Web界面功能

  • 实时上传试卷图片
  • 错题区域高亮标注
  • 可下载切分后的错题图片集

![检测效果对比图]

左:原始试卷 | 右:错题标记与切分结果

📌 教育场景适配:支持A4/B5试卷、手写批改痕迹、多科目符号体

相关实践学习
使用PAI+LLaMA Factory微调Qwen2-VL模型,搭建文旅领域知识问答机器人
使用PAI和LLaMA Factory框架,基于全参方法微调 Qwen2-VL模型,使其能够进行文旅领域知识问答,同时通过人工测试验证了微调的效果。
机器学习概览及常见算法
机器学习(Machine Learning, ML)是人工智能的核心,专门研究计算机怎样模拟或实现人类的学习行为,以获取新的知识或技能,重新组织已有的知识结构使之不断改善自身的性能,它是使计算机具有智能的根本途径,其应用遍及人工智能的各个领域。 本课程将带你入门机器学习,掌握机器学习的概念和常用的算法。
相关文章
|
2月前
|
人工智能 运维 安全
阿里云百炼平台详解:官网入口链接、免费AI大模型领取及常见问题解答FAQ
在生成式人工智能技术全面落地的当下,各类大模型已经深度融入内容创作、视觉设计、视频制作、软件开发、企业智能服务等诸多领域。对于个人创作者、独立开发者以及中小微企业而言,如何低成本、安全、便捷地使用成熟大模型服务,成为开展AI相关工作的核心诉求。阿里云百炼作为阿里云推出的一站式大模型服务平台,整合了文本、图像、视频、多模态等全品类大模型,同时配套低代码智能体开发、应用部署、全链路安全管控等能力,能够满足从个人临时使用、原型开发到企业级规模化落地的各类需求。
4023 4
|
缓存 Rust 前端开发
比Webpack快700倍的Turbopack,到底快在哪?
比Webpack快700倍的Turbopack,到底快在哪?
767 0
|
1月前
|
弹性计算 缓存 负载均衡
可用架构实践:阿里云支撑跑腿平台稳定运行,分账链解决交易结算核心痛点
同城跑腿、即时代办、即时配送属于典型的高并发、短时效、强交易、高波动业务场景:节假日、午晚高峰、暴雨暴雪天气会瞬间触发流量峰值,订单秒级涌入;同时每一笔订单都涉及用户、平台、入驻商户、跑腿个人师傅四方交易分润,业务链路复杂。 对于开发者而言,跑腿平台上线运营核心要解决两大问题:业务层高可用稳定承载 + 交易层合规自动化分账。 绝大多数成熟跑腿平台,均基于阿里云云原生架构实现业务稳定、弹性扩容、故障自愈,保障全时段服务可用;而针对行业专属的多方分账、高分润、逆向退款、合规清算难题,行业通用最优解是垂直场景专用系统——分账链。 本文从阿里云架构落地、业务痛点拆解、交易分账解决方案三个维度,完整复盘
344 122
|
1月前
|
缓存 文字识别 调度
一文分清阿里云千问Qwen3.7 Max、Plus、Flash:能力差异与场景适配方案
2026年阿里云推出通义千问Qwen3.7完整产品矩阵,包含Max、Plus、Flash三款主力商用模型,三款模型统一标配100万Token超长上下文窗口、最长35小时连续自治执行能力,但在架构设计、模态支持、推理上限、响应速度、计费单价上存在显著区分,分别对应极致专业推理、多模态综合商用、轻量化高并发三类核心需求。本文依托官方实测基准数据,从基础硬件参数、综合能力、推理速度、计费成本、落地场景五大维度横向拆解,为个人开发者、中小企业、政企研发团队提供清晰选型依据,避免选型不当造成性能不足或算力成本浪费。
944 1
|
2月前
|
Python
基于UNET的服装语义分割系统
基于UNET的服装语义分割系统
|
2月前
|
算法 PyTorch 算法框架/工具
基于PyTorch的EfficientDet进行水下目标检测 水下目标检测
项目概述:基于PyTorch的EfficientDet进行水下目标检测 在这个项目中,我们将通过实际比赛数据集演示如何训练最近开源的相对最先进的PyTorch版EfficientDet模型。本教程将涵盖从数据准备到模型训练、评估以及推断的全过程。值得注意的是,在本次实验中,我们没有采用任何数据增强技术或模型融合等后处理方法来提升模型精度;同样地,我们也未使用如UWGAN_UIE、水质迁移(WQT)、DG-YOLO或其他去雾算法对水下图像进行预处理。尽管这些技巧可能有助于提高识别准确率,但我们希望保持基础框架的纯粹性以专注于模型本身的性能。 1. 数据来源 我们的数据来自于科赛网举办的一次水下
|
2月前
|
机器学习/深度学习 文字识别 数据处理
基于OCR的水位检测项目 水位识别
基于OCR的水位检测项目 水位识别
|
2月前
|
机器学习/深度学习 编解码 JSON
基于YOLO12的智能交通分析 车道线流量分析 车辆计数识别
基于YOLO12的智能交通分析 车道线流量分析 车辆计数识别
|
2月前
|
机器学习/深度学习 安全 算法
基于YOLOV5的区域选择目标检测与报警系统(代码+教程)区域目标检测 区域入侵检测
基于YOLOV5的区域选择目标检测与报警系统(代码+教程)区域目标检测 区域入侵检测

热门文章

最新文章