视觉AI技术应用探索学习笔记

简介: 第一天-应用探索学习笔记

定义

通过一个/一系列视觉过程,产生新的视觉表达

image-20200924091138037

分类

  • 生成:从0到1
  • 扩展:从1到N
  • 摘要:从N到1(把主要的信息浓缩起来)
  • 升维:从An到An+1
  • 增强/变换:从A到B
  • 插入/合成: A+B = C
  • 擦除: A-B=C

基础通用框架

image-20200924091900976

五个关键维度

视觉生产要满足5个规范要求才是一个好的视觉

  1. 满足视觉,美学表现符合人们的审美
  2. 合乎语义,内容逻辑
  3. 保证结果的丰富性
  4. 提供用户预期的抓手,让用户可以添加一些控制因素
  5. 要具有商业价值

精细理解-分割抠图

  1. 识别:知道是什么
  2. 检测:识别+知道在哪儿(缺陷检测,多目标检测)
  3. 分割:识别+检测+知道每个像素是什么(全景分割,病灶分割)(视觉分割时生产的必要前置步骤)

分割抠图难点

  • 复杂背景
  • 遮挡
  • 发丝精抠
  • 边缘反色
  • 多尺度/目标
  • 数据不足

分割思路

思路

  1. 复杂问题拆解:mask估计+精准matting
  2. 丰富数据样本:设计图像mask同一模型

类型

  • 语义分割(Semantic Segmentation):分析出事什么东西,比如是个人
  • 实例分割(Instance Segmentation):分析出这个人是谁
  • 图像抠图技术(Image Matting):处理图像

image-20200924103243394

模型框架

image-20200924093747005

从无到有

鹿班

功能:平面图像设计生成

框架流程

image-20200924101113146

AlibaabWood

功能:短视频设计生成

框架流程

image-20200924101352822

视频编辑-移花接木

应用方面

  • 视频植入
  • 动态监测分割
  • 视频内容擦除

    • 文字擦除
    • Logo擦除
  • 画幅变化
  • 图像尺寸变化

视觉增强-修旧如新

核心逻辑

image-20200924102101381

应用方面

  • 人脸修复增强
  • 渲染图超分
  • 视频超分
  • 视频插帧
  • HDR色彩扩展
  • 风格迁移
  • 颜色扩展

视觉制造-由虚入实

核心逻辑

image-20200924102502018

应用方面

  • 包装几何生成
  • 服装几何生成
  • 视觉迁移及融合
  • 多样性拓展
  • 2D3D融合

视觉智能开放平台

集合上面的一些视觉功能以及其他的功能,网址vision.aliyun.com

相关文章
|
1天前
|
人工智能 边缘计算 算法
AI人流热力图分析监测技术
通过深度学习算法(如CSRNet)进行实时密度估算和热力图生成,结合历史数据分析预测高峰时段,优化人员调度与促销活动。采用边缘计算减少延迟,确保实时响应,并通过数据可视化工具提升管理决策效率。
33 24
|
2天前
|
人工智能 Java API
Java也能快速搭建AI应用?一文带你玩转Spring AI可落地性
Java语言凭借其成熟的生态与解决方案,特别是通过 Spring AI 框架,正迅速成为 AI 应用开发的新选择。本文将探讨如何利用 Spring AI Alibaba 构建在线聊天 AI 应用,并实现对其性能的全面可观测性。
|
1天前
|
存储 人工智能 开发框架
Spring AI Alibaba 应用框架挑战赛圆满落幕,恭喜获奖选手
第二届开放原子大赛 Spring AI Alibaba 应用框架挑战赛决赛于 2 月 23 日在北京圆满落幕。
|
1天前
|
存储 人工智能 安全
有奖体验 AI 模特换装,解锁电商视觉新体验
在电商中,制作精美的商品展示图成本高且流程复杂。AI 换装技术允许商家快速更换模特的服装或配件,无需重新拍摄,大大缩短准备时间。这项技术减少了对专业摄影师和后期团队的依赖,使中小商家也能轻松产出高质量的商品图片,灵活响应市场变化,有效降低成本,提升竞争力。本方案利用函数计算 FC 构建 Web 服务,采用百炼视觉模型 qwen-vl-max-latest、aitryon、aitryon-refiner、shoemodel-v1 来分别实现 AI 人物主体信息提取、模特试衣、试衣精修、模特换鞋。
|
3天前
|
机器学习/深度学习 人工智能 监控
AI监控智能化客户行为轨迹分析技术
本方案通过目标跟踪技术(如DeepSORT)和多摄像头协作,实时分析顾客在商场内的行为路径,识别高频活动区域,优化商场布局与商品陈列,提供个性化营销服务。基于深度学习与时序数据分析,精准捕捉顾客动线,提升购物体验与销售转化率。
|
6天前
|
人工智能 文字识别 自然语言处理
保单AI识别技术及代码示例解析
车险保单包含基础信息、车辆信息、人员信息、保险条款及特别约定等关键内容。AI识别技术通过OCR、文档结构化解析和数据校验,实现对保单信息的精准提取。然而,版式多样性、信息复杂性、图像质量和法律术语解析是主要挑战。Python代码示例展示了如何使用PaddleOCR进行保单信息抽取,并提出了定制化训练、版式分析等优化方向。典型应用场景包括智能录入、快速核保、理赔自动化等。未来将向多模态融合、自适应学习和跨区域兼容性发展。
|
8天前
|
人工智能 BI
【瓴羊数据荟】 AI x Data :大模型时代的数据治理与BI应用创新 | 瓴羊数据Meet Up第4期上海站
瓴羊「数据荟」Meet Up城市行系列活动第四期活动将于3月7日在上海举办,由中国信息通信研究院与阿里巴巴瓴羊专家联袂呈现,共同探讨AI时代的数据应用实践与企业智能DNA的革命性重构。
【瓴羊数据荟】  AI  x Data :大模型时代的数据治理与BI应用创新 | 瓴羊数据Meet Up第4期上海站
|
1天前
|
机器学习/深度学习 人工智能 Java
飞算JavaAI代码生成实战:如何用AI技术减少70%重复编码
飞算JavaAI是首个聚焦Java语言的IDEA插件,利用AI技术减少70%的重复编码工作。通过自然语言输入需求,自动完成需求分析、软件设计、逻辑处理和代码生成,全流程开发文档自动生成,显著提升开发效率。开发者可自由调整优化,快速交付高质量成果。飞算JavaAI炫技赛现已开启,欢迎体验高效开发新篇章。
|
2天前
|
人工智能 自然语言处理 监控
AI尚处于早期阶段:仅有25%的企业部署了该技术,很少有企业获得回报
AI尚处于早期阶段:仅有25%的企业部署了该技术,很少有企业获得回报
|
25天前
|
人工智能 自然语言处理 搜索推荐
【上篇】-分两篇步骤介绍-如何用topview生成和自定义数字人-关于AI的使用和应用-如何生成数字人-优雅草卓伊凡-如何生成AI数字人
【上篇】-分两篇步骤介绍-如何用topview生成和自定义数字人-关于AI的使用和应用-如何生成数字人-优雅草卓伊凡-如何生成AI数字人
124 24
【上篇】-分两篇步骤介绍-如何用topview生成和自定义数字人-关于AI的使用和应用-如何生成数字人-优雅草卓伊凡-如何生成AI数字人

热门文章

最新文章