计算机视觉

首页 标签 计算机视觉
# 计算机视觉 #
关注
26806内容
|
21天前
|
电梯内车辆入梯目标检测数据集:28,000张图像 | 目标检测
本数据集含28,000张真实电梯监控图像,精准标注“自行车”与“电动车”两类目标,覆盖多场景、多尺度、强遮挡及复杂光照条件,专为AI电梯安全防控设计,支持YOLO等主流模型训练与边缘部署,助力构建“检测-告警-阻停”闭环安防系统。(239字)
虚拟数字人直播系统搭建,打造企业智能化直播营销新模式
虚拟数字人直播系统融合AI大模型、语音合成、计算机视觉等技术,实现AI数字人自动直播、智能讲解、实时互动、脚本生成与数据分析,支持全天候、多场景智能营销,显著降本增效,推动直播从“人工驱动”迈向“AI智能运营”。
|
22天前
|
生活垃圾降解属性目标检测数据集:4类别 | 目标检测
本数据集首创以“降解能力”为分类核心,将生活垃圾划分为可生物降解、可降解、不可生物降解、不可降解四类,突破传统材质分类局限。涵盖家庭、社区等多场景图像,含YOLO格式标注,适配主流目标检测模型,支撑智能分拣、堆肥优化与碳管理落地。(239字)
|
22天前
| |
来自: 视觉智能
宠物犬类品种识别算法开发实操流程,支持180+种狗品种(附测试效果)
在人工智能与生物技术深度融合的今天,犬种识别技术已从实验室走向千家万户。犬种识别可以帮助人们更好地理解和照顾他们的宠物,同时对于遗传疾病的研究、遗失宠物的寻找以及犬只的品种改良等方面也有着重要的作用。本文以快瞳科技宠物犬种识别算法的技术原理、效果展示、代码示例及应用场景为例,从技术原理、测试效果、训练代码、应用场景等四个层面详细拆解犬种识别算法的实操细节,帮忙开发人员快速掌握该算法核心逻辑,落地相关技术方案。若有不足之处,欢迎大家指正。
taobao.item_search_img 淘宝拍立淘API 返回完整字段说明
本文详解淘宝拍立淘API(taobao.item_search_img)图像选品方案:基于CNN视觉特征检索,突破关键词局限,精准识别同款/变体,解决漏筛、非标品适配差、跨境溯源难等痛点;涵盖原理、预处理、调用规范与实战落地,助力自动化、精细化智能选品。(239字)
|
23天前
|
noimg:纯Nolang从零实现、零第三方依赖跨平台图像处理库
noimg是notools生态中的纯Nolang图像处理库,零依赖libpng/libjpeg等C库,所有编解码器与30+算子均手写实现。支持9种格式读写(含PNG/GIF/JPEG/WebP完整压缩),提供CLI工具与API双形态,单二进制跨平台分发,专为AI Agent、CI脚本及离线环境设计。
|
23天前
|
猫行为目标检测数据集:4类别、近2,000张图像 | 目标检测
本数据集含近2000张高质量猫行为图像,涵盖趴卧、坐姿、睡眠、站立4类姿态,YOLO格式标注,多场景/光照/角度覆盖,支持直接用于目标检测训练与宠物智能系统开发。(239字)
|
23天前
| |
来自: Qoder CN
别再让 AI 只会“粗剪”:开源项目 Timeline Studio 正在把专业后期交给 Agent
Timeline Studio 是开源AI视频编辑项目,本次升级聚焦专业后期理解:新增动作感知变速、镜头匹配调色、动态抠图与描边四大能力,强调“为何做”而非“能做什么”,让AI从自动粗剪迈向可验证、可编辑的专业成片。
|
23天前
| |
图生视频首帧容易崩坏?解析 Vera1.1 三级图像注入架构
本文揭秘AI视频首帧崩坏根源,提出星宇智算Vera 1.1“编码器—注入器—传播器”三级图像特征注入架构,从多尺度特征提取、分层精准注入到时序持续传播,显著提升主体一致性(94.7%)与长视频稳定性,附实战参数调优指南与落地经验。
阿里云百炼大模型视觉类模型有哪些?可选模型及能力、适用场景和最新活动介绍
本文介绍了阿里云百炼平台视觉类大模型的完整矩阵与选型策略。平台集成通义千问(Qwen)全系列自研视觉模型及DeepSeek、Kimi等第三方模型,涵盖旗舰推理(Qwen3.8-Max)、均衡型(Qwen3.6-Plus)、高性价比(Qwen-Flash)、专用OCR与视觉推理(QVQ)、开源及第三方等多条产品线,覆盖图像理解、生成、OCR、视频分析等场景。
免费试用