计算机视觉

首页 标签 计算机视觉
# 计算机视觉 #
关注
26776内容
MiniMax H3 登顶 Hugging Face:视频大模型正在改写软件测试的验收标准
MiniMax正式开源新一代多模态视频生成模型H3,支持文/图/音/视频输入,可生成4–15秒、24FPS、32kHz立体声的高质量视频,并具备首尾帧控制、多参考等能力。其在Artificial Analysis音频视频榜单登顶,引发社区广泛关注。该模型对测试提出全新挑战:需从传统功能验证转向涵盖指令遵循、时序一致性、音画同步、安全合规等七大维度的质量评估体系。
|
13天前
|
安全锥目标检测数据集:6,000张图像 | 目标检测
本数据集含6000张高质量标注图像,专为安全锥(路锥/雪糕筒)目标检测构建,支持YOLO系列模型。覆盖施工、事故、高速等多场景,涵盖倾倒、遮挡、小目标等挑战,标注规范、结构清晰,开箱即用,助力自动驾驶与智能交通系统快速落地。
基于 YOLO11 的学生课堂行为检测:从数据集准备到云上训练实践
本文介绍基于YOLO11的学生课堂行为检测全流程:从真实教室场景数据采集、12类行为(如举手、低头、使用手机等)的Label Studio标注,到云上训练配置与模型评估,兼顾精度与边缘部署需求,助力智慧教学落地。(239字)
|
14天前
|
课堂行为目标检测数据集:6类别、2,000张图像 | 目标检测
本数据集含2000张真实课堂图像,标注6类行为(举手、阅读、写作、使用手机、低头、睡觉),支持YOLO目标检测任务,兼顾积极与消极行为识别,适用于智慧教室、专注度分析及AI教育研究。
基于YOLO11的学生课堂行为检测:从数据标注到云上训练实践
本文介绍基于YOLO11的学生课堂行为检测全流程实践:涵盖12类行为的数据标注、云上存储与版本管理、YOLO格式转换、模型训练调优及评估复核,并提供工程化部署建议,助力智慧教育场景快速落地。(239字)
|
14天前
|
危大工程设备监测在智慧工地平台中的业务逻辑与预警闭环
该系统聚焦危大工程设备智能管理,涵盖塔吊、施工升降机、卸料平台、高支模、深基坑等六大物联网监测子系统,集成硬件传感、实时预警、人脸识别、声光报警等功能,并通过统一平台实现设备台账、人员管控、报警闭环、历史追溯与全生命周期管理,提升施工安全与监管效能。
|
15天前
|
学生课堂行为目标检测数据集:3类别、4,200张图像 | 目标检测
本数据集含4200张课堂图像,标注举手、阅读、书写三类学生行为,采用YOLO格式,适配YOLOv5/v8等模型训练。适用于智慧教育、教学分析及CV科研,助力从经验教学迈向数据驱动的课堂优化。(239字)
2026年5个PCB缺陷检测开源软件测评:从能力与场景匹配度看选型
本文梳理五个 PCB 缺陷检测开源项目,覆盖图像批检、实时视频流、X-Ray 焊点处理、YOLO/Faster R-CNN 训练及 Jetson 边缘推理等路径。读者可结合缺陷对象、数据标注格式、算力条件、部署环境与运维需求,匹配适合自身产线验证和研发迭代的方案。
YOLOv13如何提升NEU-DET的检测精度 | 新颖的多尺度卷积注意力(MSCA)加在网络不同位置的涨点情况
如何用自己的数据集训练YOLOv13,在NEU-DET任务中YOLOv13原始mAP50为0.742;yolov13-MSCA原始mAP50为0.742提升至0.746;yolov13-MSCA1原始mAP50为0.742提升至0.749;yolov13-MSCA2原始mAP50为0.742提升至0.749
YOLOv13-pose关键点检测:新颖的特征融合方法-金字塔稀疏 Transformer(PST),助力pose检测
YOLOv13+PST Pose mAP50 为0.909, YOLOv13 Pose mAP50 为0.893,相较于YOLO11的Pose mAP50 为  0.871  ,大幅提升
免费试用