本地生活技术雷达——生成式AI(Generative AI)在阿里本地生活的应用与思考

简介: 本地生活技术雷达是由本地生活技术中心战略管理&PMO团队开展的,定期扫描和评估新兴技术的战略研究工作。目的是对技术趋势进行前瞻性预判,提出新技术布局建议,在技术驱动业务创新和业务增长、践行社会责任等方面有一些实质性探索。本篇尝试探讨1)理解AI范式——从分析型(Analytical AI)到生成式(Generative AI)的拐点在2022年,其对人类社会以及商业模式的长期影响;2)生成式AI(文生文、文生图、图生图等)在本地业务目前场景的应用和未来的方向。欢迎技术、产品、运营、战略、管理层、国内国际等各种视角的指点和碰撞!

一、AIGC的重要发展拐点和历史进程



1.从Analytical AI到Generative AI的转移

     此前的分析型AIAnalytical AI)是根据已有数据进行分析、判断、预测,典型应用为内容的智能推荐(短视频)、自动驾驶等;生成式AIGenerative AI)更强调学习归纳后进行演绎创造,生成全新的内容。



2.算法迭代的理解

     在预训练大模型的基础上,AI生成能力的落地体现2022年主要在两个维度:1Text-to-Image生成模型的代际性迁移所带来的高质量、快速、多样性三者兼得的大规模应用落地;2)开放域生成式对话工具(Text-to-TextTransformer-basedChat-GPT的提出。

从第一个Text-to-Image生成模型的演变来看

image.png

从第二个Text-to-Text Transformer-basedChatGPT的提出来看

image.png

3.实际行业应用

对行业格局的理解:尽管AIGC需要巨量算力、资金和研发人才、调参人员,Generative AI本质是一个"巨头的生意",目前成立的大量创业公司会被收购或者消失,但行业的生态位和社会化分工依然给中小玩家和垂直领域提供了机会。

image.png



尽管不同领域的成熟度不一样,从应用历史进程预测来看,Gartner预测从文字生成文字的能力到2025年水平高于人类平均水平。

image.png

具体代表性公司如下:这里面的成熟度每天日新月异,公司的代表性产品也在不断迭代和拓展,欢迎大佬们随时Update

image.png

具体来举两个市场上的创业公司生动的例子,玩起来~

(别着急,本地生成能力例子也有,在后面,请一直看下去O(_)O~!)

一个生成文案

image.png



一个生成图片

image.png



最近Microsoft Bing的发布会上结合ChatGPT后新的搜索引擎的对复杂问题的解决/生成能力

image.png

4.生成式AI对行业和工作方式影响的预判

中短期,text-texttext-imagetext-videoimage-imageimage-video等技术还在不断成熟,主要对内容相关行业有较大影响,对电商等运营驱动行业,在营销、商品、客服等环节有局部影响

中长期,在text-x单维度能力成熟后,将演变为以业务\运营目标为导向的多维度组合生成能力,改变软件交互方式,在线上化-实时化-智能化发展过程中,智能化阶段从目前的分析\决策智能化演进为分析\决策智能化+生成智能化(多维度内容组成的场景),对以运营为主的互联网公司会产生综合影响。以营销活动会场搭建为例,将基于营销活动目标、活动主题等,智能化生成包含textimagevideo等内容形态的营销会场等。

(这里有共鸣的小伙伴欢迎来举例!)

image.png



在落地先后的判断上,预计设计师比程序员更早受到实际影响,一是模型技术成熟度,二是两者对生成内容的容错率不同,三是设计和创作行业已验证所需成本因AIGC大幅降低。可参考A16Z

各位技术大神、设计大神可能都有一些使用这类AIGC工具的反馈,欢迎大家来聊自己的体验和判断!你的反馈可能是下一个深入研究的入口~



5. 行业性挑战问题

image.png



二、阿里集团在生成式AI的相关能力布局

image.png



三、生成式AI在本地生活的应用场景及技术布局建议



中短期2年内投入资源优先级思考

这里Highlight1AIGC在商品信息质量管理中降本提效的作用,以及2)作为整体AI发展的重要基建:垂直领域的多模态知识图谱。image.png





具体看Text-to-text场景

image.png



具体看Text-to-image场景

image.png





具体看Image-to-Image场景

image.png



具体看Text-to-text生成对话能力

image.png



具体看多模态知识图谱

image.png





四、参考学习

在这里冒昧放一张淘宝META技术在AIGC方向的探索,作为我们学习和参照的落地方~

image.png



五、思考和未来探索

image.png

Last but not the least

 

 





 

相关文章
|
1天前
|
人工智能 边缘计算 Kubernetes
阿里云边缘容器云帮助AI推理应用快速落地
2024全球分布式云大会·北京站,阿里云徐若晨演讲内容分享
10 0
|
4天前
|
人工智能 决策智能 C++
【AI Agent系列】【阿里AgentScope框架】5. Pipeline模块的组合使用及Pipeline模块总结
【AI Agent系列】【阿里AgentScope框架】5. Pipeline模块的组合使用及Pipeline模块总结
18 1
|
4天前
|
人工智能 搜索推荐 决策智能
【AI Agent系列】【阿里AgentScope框架】1. 深入源码:详细解读AgentScope中的智能体定义以及模型配置的流程
【AI Agent系列】【阿里AgentScope框架】1. 深入源码:详细解读AgentScope中的智能体定义以及模型配置的流程
35 0
|
4天前
|
存储 人工智能 开发框架
【AI Agent系列】【阿里AgentScope框架】0. 快速上手:AgentScope框架简介与你的第一个AgentScope程序
【AI Agent系列】【阿里AgentScope框架】0. 快速上手:AgentScope框架简介与你的第一个AgentScope程序
24 0
|
4天前
|
人工智能 监控 数据处理
【AI大模型应用开发】【LangSmith: 生产级AI应用维护平台】1. 快速上手数据集与测试评估过程
【AI大模型应用开发】【LangSmith: 生产级AI应用维护平台】1. 快速上手数据集与测试评估过程
18 0
|
4天前
|
人工智能 监控 数据可视化
【AI大模型应用开发】【LangSmith: 生产级AI应用维护平台】0. 一文全览Tracing功能,让你的程序运行过程一目了然
【AI大模型应用开发】【LangSmith: 生产级AI应用维护平台】0. 一文全览Tracing功能,让你的程序运行过程一目了然
8 0
|
4天前
|
人工智能 API 开发者
【AI大模型应用开发】0.2 智谱AI API接入详细步骤和简单应用
【AI大模型应用开发】0.2 智谱AI API接入详细步骤和简单应用
16 0
|
9天前
|
机器学习/深度学习 人工智能 算法
未来AI技术的发展与应用前景
随着人工智能(AI)技术的迅速发展,其在各个领域的应用前景备受关注。本文将探讨未来AI技术的发展趋势,以及其在医疗、交通、教育等领域的潜在应用,展望AI技术对未来社会的影响和改变。
17 1
|
12天前
|
机器学习/深度学习 编解码 人工智能
Transformer 和扩散模型的生成式 AI 实用指南(预览版)
Transformer 和扩散模型的生成式 AI 实用指南(预览版)
21 1
Transformer 和扩散模型的生成式 AI 实用指南(预览版)
|
15天前
|
机器学习/深度学习 人工智能 算法
AI战略丨AI原生时代,应用创新蓄势待发
通过热点AI应用创新项目的观察,我们可以看到新技术的突破方向,也能发现基于生成式AI迸发出的全新商业前景落地的可能性。
AI战略丨AI原生时代,应用创新蓄势待发