|
5月前
|
人工智能 监控 数据可视化
|

【AI加持】基于PyQt5+YOLOv8+DeepSeek的摔倒行为检测系统(详细介绍)

本文介绍了一个基于PyQt5+YOLOv8+DeepSeek的摔倒行为检测系统。该系统整合了计算机视觉与自然语言处理技术,支持对图片、视频、摄像头等多种数据源的实时检测,并具备智能评估功能。系统采用PyQt5开发GUI界面,YOLOv8进行目标检测,DeepSeek提供语义分析,同时使用CSV存储数据和多线程优化性能。功能包括登录注册、实时检测、历史记录查询等,适用于养老院、医院等场景,具有重要的社会应用价值和技术创新意义。

531 3
|
5月前
|
人工智能 自然语言处理 监控
|

企业如何抓住AI红利?阿里云权益中心深度解读与实战指南

本文深度解析阿里云AI权益中心的核心价值与落地场景,涵盖Qwen大模型、JVS Claw智能体平台等全栈能力,助力企业降本增效——电商视频生成成本直降99%,内容创作提效18倍。附技术选型框架与实战指南。(239字)

493 9
|
5月前
|
人工智能 运维 安全
|

基于端侧 AI 与云边协同的电力智能巡检解决方案实践

电力巡检面临人工依赖高、效率低、安全风险大、数据难闭环等痛点。本方案基于云-边-端协同架构,融合端侧轻量化AI、多模态感知与弱网适配技术,打造工业级AR智能安全帽,实现变电站、输电线路等场景的智能识别、实时预警、全程追溯与安全管控,助力电网数字化升级。

1082 0
|
6月前
|
机器学习/深度学习 存储 人工智能
|

AI解说大师Agent Skill详解:如何让智能体具备自主任务规划能力?

本文深度解析AI Agent“技能(Skill)”的本质,破除“仅封装CLI/API”的误区,揭示真正核心是任务规划能力——让AI像项目经理一样理解意图、拆解任务、自主决策、传递数据、容错恢复。以“AI解说大师”为例,详解原创/二创双路径规划、数据流依赖管理与Markdown结构化Skill设计,推动Agent从执行者跃升为“懂思考的协作者”。

1103 0
|
6月前
|
芯片 内存技术
|

电路设计调试:那些书本上没写,但实际中常踩的坑

本文揭秘硬件设计中高频踩坑点:从电阻电容选型失当、电源啸叫与冲击、时序偏差、信号反射串扰,到EMC防护失效及高低温失效机理。强调“基础不牢,地动山摇”,提醒工程师重视元器件参数、阻抗匹配、回流路径等细节,少走弯路。(239字)

311 0
|
6月前
|
芯片
|

辐射超标、静电复位等等这些EMC问题背后藏着什么?

本文结合典型工程案例,系统解析EMC设计四大关键环节:结构屏蔽与接地(如悬空金属、散热器接地)、电缆与接口防护(如Pigtail问题、ESD保护)、滤波设计(如滤波器安装、TVS选型)及PCB布局(地平面完整性、滤波电容 placement)。强调EMC需前置设计,而非事后整改。(239字)

466 0
|
6月前
|
传感器 算法 安全
|

AR 眼镜多模态融合:视觉、语音与 IMU 的端侧协同实践

本文介绍AR眼镜端侧多模态融合方案,通过视觉、语音与IMU协同,解决工业场景中强光、噪声、漂移等挑战;采用硬件触发同步、动态加权融合与INT8量化优化,实现≤15ms低延时、91%高识别率及22%功耗降低,已在五矿盐湖项目落地验证。

637 0
|
6月前
|
传感器 人工智能 监控
|

协作机器人和工业机器人的区别

协作机器人(Cobot)是专为人机协同设计的工业机器人分支,以安全、灵活、易用为核心,通过力控感知、速度监控与ISO/TS 15066认证实现无围栏共作;支持拖拽示教、快速换型,部署快、成本低、ROI短(6–18个月),适用于打磨、柔性装配、医疗辅助等非标场景。(239字)

963 1
|
6月前
|
人工智能 算法 vr&ar
|

边缘AI算法在工业AR眼镜中的部署实践:从模型轻量化到端侧推理

本文分享AR眼镜端侧AI部署实践:针对工业无网/弱网、毫秒级响应需求,通过知识蒸馏+INT8量化+剪枝将模型压缩至<10MB;选用MNN引擎优化推理,实测仪表OCR(38ms/99.2%)、缺陷检测(42ms/98.7%)等任务均满足实时性与精度要求。

1084 2
|
6月前
|
编解码 文字识别 安全
|

AutoGod:安卓5-16全兼容!一站式自动化框架,开发效率直接拉满

Auto-God是一站式安卓自动化框架,兼容Android 5–16,覆盖手势、视觉(OCR/YOLO)、网络、UI(Material3悬浮界面)、拓展及安全(防HOOK/抓包/破解)全能力,开箱即用,真机/模拟器/云手机全支持,让自动化开发更简单、高效、安全。

1294 1
|
6月前
|
人工智能 运维 安全
|

解放双手,透视数据:AR+AI技术正在如何解决 新能源储能行业的老大难问题

在新能源储能工厂,AR+AI智能眼镜正革新传统巡检:设备信息“长”在眼前,AI自动识读仪表、预警异常,远程专家实时指导。它不替代人,而是赋能一线——让巡检更准、更快、更安全。

297 1
来自: 图像搜索  版块
|
6月前
|
机器学习/深度学习 人工智能 编解码
|

视频字幕擦除与动态修复技术深度解析:从开源算法基准到高并发SaaS架构的演进

本报告深度解析视频硬字幕擦除与修复技术演进,涵盖光流传播、时空Transformer(如ProPainter)及扩散模型等前沿算法;对比开源工具、桌面软件与SaaS云平台,指出云端原生架构在算力解耦、热更新、高并发与易用性上的断代优势,为工业落地提供权威指南。

1104 1
|
6月前
|
机器学习/深度学习 编解码 算法
|

SPMamba-YOLO:多尺度增强+全局建模,水下目标检测精度飙升4.9%!

本文提出SPMamba-YOLO水下目标检测模型:创新融合SPPELAN(增强多尺度特征与感受野)、PSA注意力(抑制背景、提升小目标判别)及Mamba状态空间模块(建模长程依赖),在URPC2022上mAP@0.5达82.5%,超越YOLOv8n 4.9%。

690 2
|
6月前
|
Cloud Native 算法 测试技术
|

基于云原生架构的 AIGC 视频后处理实践:应对扩散模型纹理挑战

随着 AIGC 视频生成规模化应用,视频后处理能力逐渐成为系统吞吐与质量保障的关键环节。本文结合实际工程实践,分析扩散模型生成视频在高频纹理与时间一致性方面的挑战,并探讨基于云原生架构的 GPU 化后处理方案。通过引入生成式重构与弹性算力调度,实现视频修复性能与吞吐能力的显著提升。

428 1
来自: 分割抠图  版块
|
6月前
|
机器学习/深度学习 人工智能 文字识别
|

视频后期黑科技:深度拆解开源 VSR 架构与视频 Inpainting 实践全指南

本文深度解析视频补全(Video Inpainting)前沿技术,聚焦硬字幕去除工具VSR的底层架构(OCR定位、时序传播、光流对齐)、本地部署要点(CUDA环境、显存优化)及云端方案(550W AI扩散模型),对比二者在隐私、效率与画质上的差异,助力开发者科学选型。(239字)

669 4
|
7月前
|
人工智能 JSON 算法
|

AI Glasses识别百变脸谱

本项目提出“AI脸谱眼镜”方案:通过端云协同架构,结合人脸检测、EasyDL脸谱识别、戏曲百科与AR投射技术,让观众佩戴眼镜即可实时获取京剧角色名、性格、行当等信息。卡片投射于视野下方,不遮挡表演,专为戏迷、游客及学生设计,助力传统文化沉浸式普及。(239字)

501 6
|
7月前
|
传感器 人工智能 Java
|

当AI Glasses走进小吃街,实现美食百科

这是一款面向吃货的AI眼镜系统,融合图像识别、美食百科与AR投射技术。用户扫视小吃,即刻获取名称、热量、辣度、成分及推荐指数等信息,端云协同实现500ms内响应。支持健康色标(绿/黄/红)、动态百科更新与场景化提示,让逛吃更聪明、更安心。(239字)

293 2
|
7月前
|
机器学习/深度学习 人工智能 编解码
|

AI视频去字幕技术完全指南:原理、方法与工具对比(2026版)

本文深度解析AI视频去字幕技术,涵盖原理(OCR检测+GAN修复+时序一致性)、主流工具横评、分步实操教程及短视频、教育、影视等六大行业应用。适合创作者、自媒体人与技术爱好者,20分钟掌握高效去字幕方法。

2410 1
|
7月前
|
JSON 人工智能 API
|

【ComfyUI API 自动化利器:comfyui_xy Python 库使用详解】

`comfyui_xy` 是一个轻量级 Python 客户端库,封装 ComfyUI API,支持一键上传图片/遮罩、动态修改工作流、自动排队执行与结果下载(图/视/音频)。安装即用,无需处理底层 HTTP/WebSocket 细节,助力 AIGC 自动化开发。开源免费,PyPI 可装。

2584 128
|
8月前
|
人工智能 前端开发 数据安全/隐私保护
|

【编号2571】AI 文生图 & 图生图工具开发与应用经验:高效解决批量图文生成痛点

AI 文生图工具,AI 图生图工具,Python AI 图文生成,批量生成无水印图片,Selenium 浏览器自动化,TKinter 界面开发,AI 生成图片去水印,批量图生图参数配置,参考图批量生成,AI 图文生成错误恢复

598 12
来自: 图像生产  版块
|
8月前
|
机器学习/深度学习 传感器 人工智能
|

构建AI智能体:九十五、YOLO视觉大模型入门指南:从零开始掌握目标检测

本文介绍了视觉大模型及YOLO目标检测技术,重点讲解YOLOv8在CPU上的部署与应用。涵盖模型选择、图像检测、实时摄像头识别及性能优化,适合初学者快速上手。

1295 2
|
9月前
|
前端开发 安全 Java
|

自定义认证前端页面

本示例演示Spring Security基础配置:前端引入登录页,后端新增接口与安全配置。通过SecurityConfig实现请求认证、表单登录、自定义跳转等,启动后访问/demo/index自动跳转登录页,认证成功返回提示信息,完成权限控制验证。

189 1
|
9月前
|
传感器 算法 机器人
|

医疗引导机器人技术架构解析:决定品牌竞争力的核心要素

智慧医院建设推动医疗引导机器人迈向智能化,其核心技术涵盖多传感器融合导航、垂直领域大模型与RAG语义理解、主动视觉交互、跨楼层梯控及HIS系统深度集成。本文从技术架构出发,剖析环境感知、认知决策与系统协同的关键突破,揭示机器人如何成为连接物理空间与数字医疗的核心终端。

464 2
|
9月前
|
文字识别 自然语言处理 算法
|

智慧政务大厅的数字化转型:关键技术架构与终端解决方案评测

智慧政务大厅正迈向智能化,通过边缘计算、AI与物联网技术融合,构建“感知—认知—行动”闭环。依托大模型、OCR、生物识别等技术,实现语义理解、智能导办与设备协同,推动服务从“能办”到“好办、主动办”升级。

602 20
|
9月前
|
人工智能
|

# 用Prompt Engineering高效生成合规Amazon包类套图

利用Prompt Engineering,仅需1张实拍图+产品参数,即可高效生成符合Amazon美国站合规要求的包类套图。通过结构化提示词,明确主图、卖点、场景等6类图片职责,确保每张图精准传达信息,避免AI篡改产品细节,实现低成本、可复用、规模化出图,大幅提升上架效率。

1000 1
来自: 图像生产  版块

用 Nano Banana Pro 批量生成城市天气视觉卡片

本文介绍如何用Nano Banana Pro批量生成统一风格的城市天气视觉卡片。通过结构化Prompt模版,固定视角、构图与尺寸(1080×1080),结合等距3D卡通风格,将北京、上海等城市的天气信息(晴/阴/雨/夜)转化为直观、稳定的视觉内容,适用于内容平台、城市账号或系统看板,实现高效复用与扩展。

741 0
来自: 图像生产  版块
|
9月前
|
前端开发 小程序 JavaScript
|

A2UI 规范与 AG-UI 协议:打造高效协同的界面开发体系

A2UI规范与AG-UI协议构建“设计-开发”协同闭环:前者统一视觉与交互标准,后者定义组件通信与跨平台适配,二者融合提升协作效率、保障体验一致,推动界面开发向标准化、可复用、高效能演进。

3522 0
|
10月前
|
文字识别 算法 数据可视化
|

2025 年度机器视觉公司有哪些:从技术实力到落地案例的全方位选型参考

在智能制造背景下,机器视觉成为提质增效关键。本文发布2025年度机器视觉公司评估,从技术、场景、服务三大维度解析领先企业方案,聚焦苏州德创测控等代表,涵盖核心技术、落地案例与产教融合,为制造企业选型提供权威参考,助力智能升级。

471 0
|
10月前
|
机器学习/深度学习 传感器 人工智能
|

实力强劲的机器视觉公司有哪些:2025年TOP5精选榜单

科技迭代驱动工业升级,机器视觉成自动化核心。本文基于资质、技术与口碑,精选TOP5机器视觉公司:德创测控、海康威视、康耐视、基恩士、大华华睿,覆盖全链条方案,助力企业降本增效、智能转型。

1265 0
|
10月前
|
人工智能 自然语言处理 安全
|

程序员都在偷偷用的AI编程神器!2025高效自动写代码工具全解析

AI编程革命正悄然兴起。李响团队调研显示,AI助手大幅提升开发效率,GitHub Copilot、CodeWhisperer、Tabnine各具优势,而新兴的Lynx AI更以自然语言生成全栈应用,零门槛、多端适配,助力开发者从重复劳动中解放,专注创新。

5206 3
来自: 内容审核  版块
|
10月前
|
人工智能 缓存 编解码
|

FFmpeg 官方汇编课程:写出快 5 倍的视频处理代码

FFmpeg官方开源汇编教程asm-lessons,手把手教你用SIMD指令优化音视频处理性能。从工具链到实战案例,掌握工业级高性能代码编写,提升程序效率数倍,适合C语言开发者进阶学习。

558 10
来自: 视频分割  版块
|
10月前
|
机器学习/深度学习 人工智能 自然语言处理
|

AI内容创作Agent架构解析:基于移动端原生框架的内容特工队AI (ReelsAgent)与传统短视频工具的技术差异

传统的AI视频工具链往往基于单点功能堆栈或PC/Web端的SaaS架构,难以承载短视频营销所需的高频、高并发、全流程自动化需求。本文将从AI Agent系统架构角度,对比内容特工队AI (ReelsAgent)的移动端原生设计与现有主流工具的实现路径,以评估其在工程实践中的优劣。

986 7
|
10月前
|
传感器 人工智能 边缘计算
|

机器视觉公司有哪些:国产平台德创引领产教融合

本文整合苏州德创、基恩士、康耐视、奥普特、研华科技五家机器视觉公司,涵盖资质、产品、产教融合优势,提供选型参考,助力院校实现教学与产业需求精准对接。

546 0
|
10月前
|
人工智能 运维 算法
|

机器视觉公司有哪些:德创测控引领,产教融合优选指南​

本文依据权威报告,结合产教适配度、技术成熟度与服务保障力,推荐苏州德创、海康机器人、凌云光、大恒图像、华数机器人五家机器视觉公司,助力用户科学决策。

566 0
|
10月前
|
机器学习/深度学习 算法 机器人
|

机器视觉软件平台哪个好:2025领衔的选型指南

本文基于权威报告,对比苏州德创、康耐视、凌云光、海康机器人、基恩士五大机器视觉软件平台,从算法能力、易用性、兼容性及教学工业适配性等维度分析,为选型提供可溯源依据。德创VisionPlus国产全栈适配,教学与工业双优。附选购指南,助力精准决策。

1581 0
|
11月前
|
机器学习/深度学习 文字识别 Shell
|

高效率办公PDF批量处理:批量OCR识别PDF区域文字内容,用PDF内容批量改名或导出表格的货物运单应用案例

针对铁路货运物流单存档需求,本项目基于WPF与飞桨OCR技术,实现批量图片多区域文字识别与自动重命名。用户可自定义识别区域,系统提取关键信息(如车号、批次号)并生成规范文件名,提升档案管理效率与检索准确性,支持PDF及图像文件处理。

1420 48
来自: 文字识别  版块
|
12月前
|
机器学习/深度学习 PyTorch 算法框架/工具
|

pytorch基于AnimeFace128数据集训练DCGAN

基于AnimeFace128数据集,使用PyTorch构建DCGAN生成动漫人脸。包含生成器与判别器网络设计、数据加载及训练流程,通过对抗学习生成64×64清晰图像。

435 0
|
12月前
|
机器学习/深度学习 编解码 Python
|

Python图片上采样工具 - RealESRGANer

Real-ESRGAN基于深度学习实现图像超分辨率放大,有效改善传统PIL缩放的模糊问题。支持多种模型版本,推荐使用魔搭社区提供的预训练模型,适用于将小图高质量放大至大图,放大倍率越低效果越佳。

899 3
|
12月前
|
人工智能 数据可视化 前端开发
|

AI Ping:精准可靠的大模型服务性能评测平台

AI Ping是清华系团队推出的“大模型服务评测平台”,被誉为“AI界的大众点评”。汇聚230+模型服务,7×24小时监测性能数据,以吞吐量、延迟等硬指标助力开发者科学选型。界面简洁,数据可视化强,支持多模型对比,横向对标国内外主流平台,为AI应用落地提供权威参考。

2662 3

OBS美颜美肌插件安装使用教程

软件是不自带美颜插件的,可以安装OBS-Studio-29.1.3安装包,就自带美颜功能的插件。在OBS软件【插件中心】菜单下,打开【打开插件中心】,安装美颜摄像头注册即可。在OBS软件【停靠窗口】菜单下,打开【美颜参数控制面板】的美颜窗口。插件里面有自带教程,可以自行学习。

2159 2
|
机器学习/深度学习 算法 定位技术
|

Baumer工业相机堡盟工业相机如何通过YoloV8深度学习模型实现裂缝的检测识别(C#代码UI界面版)

本项目基于YOLOv8模型与C#界面,结合Baumer工业相机,实现裂缝的高效检测识别。支持图像、视频及摄像头输入,具备高精度与实时性,适用于桥梁、路面、隧道等多种工业场景。

1423 27
|
机器学习/深度学习 缓存 文字识别
|

【繁体图片文字识别】竖排的繁体图片文字识别翻译,竖排的繁体图片文字如何识别,竖排繁体图片识别后转横排,竖排的繁体识别比较友好的方法

竖排繁体文字识别系统适用于古籍数字化、港澳台文档、书法作品、历史档案及学术研究等场景,支持图像预处理、自动旋转、OCR识别、竖转横与繁转简。通过咕嘎OCR与OpenCC技术,实现高效精准的文字转换与编辑。

1765 3
来自: 文字识别  版块
|
机器学习/深度学习 人工智能 编解码
|

AI视觉新突破:多角度理解3D世界的算法原理全解析

多视角条件扩散算法通过多张图片输入生成高质量3D模型,克服了单图建模背面细节缺失的问题。该技术模拟人类多角度观察方式,结合跨视图注意力机制与一致性损失优化,大幅提升几何精度与纹理保真度,成为AI 3D生成的重要突破。

1681 0

【PDF提取内容改名】批量提取PDF指定区域内容重命名PDF文件,PDF自动提取内容命名的方案和详细步骤

本工具可批量提取PDF中的合同编号、日期、发票号等关键信息,支持PDF自定义区域提取并自动重命名文件,适用于合同管理、发票处理、文档归档和数据录入场景。基于iTextSharp库实现,提供完整代码示例与百度、腾讯网盘下载链接,助力高效处理PDF文档。

1669 40
来自: 文字识别  版块

视觉智能

为开发者提供高易用、普惠的视觉API服务,帮助企业快速建立视觉智能技术应用能力的综合性视觉AI能力平台。适用于数字营销、互联网娱乐、安防、手机应用、泛金融身份认证等行业。

0
今日
12958
内容
3
活动
897
关注
你好!
登录掌握更多精彩内容

相关产品

  • 视觉智能开放平台