视觉智能开放平台

首页 标签 视觉智能开放平台
AniDoc:蚂蚁集团开源 2D 动画上色 AI 模型,基于视频扩散模型自动将草图序列转换成彩色动画,保持动画的连贯性
AniDoc 是一款基于视频扩散模型的 2D 动画上色 AI 模型,能够自动将草图序列转换为彩色动画。该模型通过对应匹配技术和背景增强策略,实现了色彩和风格的准确传递,适用于动画制作、游戏开发和数字艺术创作等多个领域。
MangaNinja:开源线稿着色工具,自动匹配图像风格,一键快速上色
MangaNinja 是一款基于参考图像的线稿着色工具,通过创新的补丁重排模块和点驱动控制方案,实现精准颜色匹配和复杂场景处理,适用于漫画、插画和数字艺术创作。
|
10月前
| |
来自: 视觉智能
实力强劲的机器视觉公司有哪些:2025年TOP5精选榜单
科技迭代驱动工业升级,机器视觉成自动化核心。本文基于资质、技术与口碑,精选TOP5机器视觉公司:德创测控、海康威视、康耐视、基恩士、大华华睿,覆盖全链条方案,助力企业降本增效、智能转型。
|
6月前
| |
来自: 视觉智能
视频字幕擦除与动态修复技术深度解析:从开源算法基准到高并发SaaS架构的演进
本报告深度解析视频硬字幕擦除与修复技术演进,涵盖光流传播、时空Transformer(如ProPainter)及扩散模型等前沿算法;对比开源工具、桌面软件与SaaS云平台,指出云端原生架构在算力解耦、热更新、高并发与易用性上的断代优势,为工业落地提供权威指南。
|
5月前
| |
来自: 视觉智能
【AI加持】基于PyQt5+YOLOv8+DeepSeek的摔倒行为检测系统(详细介绍)
本文介绍了一个基于PyQt5+YOLOv8+DeepSeek的摔倒行为检测系统。该系统整合了计算机视觉与自然语言处理技术,支持对图片、视频、摄像头等多种数据源的实时检测,并具备智能评估功能。系统采用PyQt5开发GUI界面,YOLOv8进行目标检测,DeepSeek提供语义分析,同时使用CSV存储数据和多线程优化性能。功能包括登录注册、实时检测、历史记录查询等,适用于养老院、医院等场景,具有重要的社会应用价值和技术创新意义。
|
5月前
| |
来自: 视觉智能
【AI加持】基于PyQt+YOLO+DeepSeek的口罩佩戴检测系统(详细介绍)
本文介绍了一个基于PyQt+YOLO+DeepSeek的口罩佩戴检测系统。该系统利用YOLOv8实现高效目标检测,结合PyQt5构建可视化界面,并集成DeepSeek模型进行智能分析。支持图片、视频、摄像头等多种数据源输入,可实时检测口罩佩戴情况。系统采用多线程技术保证流畅运行,并使用SQLite3进行数据存储管理。该方案有效解决了公共场所口罩佩戴监测难题,相比人工巡查显著提升了管理效率和准确性,为智慧城市建设和公共卫生安全管理提供了智能化解决方案。
|
10天前
| |
来自: 视觉智能
DocClaw:让文档 Agent 记住自己刚刚读过哪里
DocClaw提出统一文档智能框架,将任务差异置于技能层、可复用知识存于状态层、感知动作交给工具层,实现OCR、DocQA与KIE共享交互过程,显著提升多轮查询质量与效率。(239字)
免费试用