带你读《2022技术人的百宝黑皮书》——全景封面视频生成技术在淘宝的应用(9)

简介: 带你读《2022技术人的百宝黑皮书》——全景封面视频生成技术在淘宝的应用(9)

带你读《2022技术人的百宝黑皮书》——全景封面视频生成技术在淘宝的应用(8) https://developer.aliyun.com/article/1243471?groupCode=taobaotech




等角度立方体投影格式的全景视频原始画面(文字方向都是基于旋转后天空在上、地面在下、画面方向正常的情况标注的):


image.png


观察截图可以发现,画面上半部分即为面向前方时的横向(左右)扫视图,下半部分逆时针旋转 90° 后即为面向后方时的纵向(上下)扫视图。


从投影质量、投影效率和带宽来进行对比,EAC 是三者中最优的。但由于历史和易于展示/编辑的原因,市面上摄像设备普遍产出的是 ERP 投影的全景视频。


在新零售工作台上,商家上传的是 ERP 投影的全景视频,上传后内容中台将转换为 EAC 投影来供手淘进行渲染播放。我们的封面视频生成环节是在商家的上传流程中,因此需要渲染的是 ERP 投影的全景视频。


3D 渲染基础知识


了解完投影的方式,接下来看如何实现投影。这部分涉及到一些 3D 渲染的基础知识。


想在屏幕上展示 3D 物体,大体上的思路是这样的:


1. 创建一个三维空间,称之为场景(Scene)

2. 确定一个观察点,并设置观察的方向和角度,称之为相机(Camera)

3. 在场景中添加供观察的物体(Objects),物体有网格(Mesh), 线(Line), 点(Points)等

4. 最后我们需要把所有的东西渲染到屏幕上


下面来具体看一看这些概念。


场景


场景(Scene)是所有物体的容器,也对应着我们创建的三维世界。


相机


相机(Camera)就相当于我们的眼睛,为了观察这个世界,我们需要描述某个物体的位置。描述物体位置需要用到坐标系。常用的坐标系有左手坐标系和右手坐标系。


image.png


常用的有两种相机,正投影相机(OrthographicCamera)和透视投影相机(PerspectiveCamera):


image.png


上面左图是正交投影,物体反射的光平行投射到屏幕上,其大小始终不变,所以远近的物体大小一样。在渲染一些 2D 效果和 UI 元素的时候会用到;右图是透视投影,符合我们平时看东西的感觉,近大远小,经常用在 3D 场景中。



带你读《2022技术人的百宝黑皮书》——全景封面视频生成技术在淘宝的应用(10) https://developer.aliyun.com/article/1243469?groupCode=taobaotech



相关文章
|
4月前
|
人工智能 定位技术 Go
从零搭建 Harness Engineering 框架 :Rule、Skill、Sub-Agent等工程落完整路径
Harness Engineering 是一套让AI在真实项目中稳定、可靠交付的工程系统,涵盖SPEC规范、Rule约束、Skill流程、Sub-Agent分工、Workflow编排、Script校验与MCP集成。它不追求模型更聪明,而是通过结构化机制消除随意性,实现可验证、可维护、可持续的AI协作开发。
1116 1
从零搭建 Harness Engineering 框架 :Rule、Skill、Sub-Agent等工程落完整路径
|
数据库 应用服务中间件 Dubbo
|
7月前
|
监控 数据挖掘 API
从踩坑到高效落地:淘宝商品详情API的实操心得
淘宝商品详情API提供全维度商品数据,含基础信息、详情页HTML、SKU、价格、销量等,支持比价、代购、数据分析及内容电商等场景,涵盖item.get、item.get_pro等核心接口,接入便捷高效。
|
7月前
|
人工智能 机器人 大数据
景区日接待量大:基于阿里云AI技术,智能语音机器人如何实现高峰期咨询自动分流与问题预判?
随着文旅消费升温,热门景区在节假日面临咨询暴增、响应滞后等服务压力。基于阿里云AI技术(ASR语音识别、通义千问大模型、PAI平台、大数据分析)构建的智能语音机器人,可实现嘈杂环境精准识音、景区意图深度理解、紧急需求自动分层与高频问题预判,并联动人工及业务系统,提升高峰期服务稳定性与游客体验。合力亿捷等厂商协同落地,加速文旅数字化升级。
465 1
|
8月前
|
人工智能 自然语言处理 机器人
多格式兼容+批量导入:AI知识库内容管理高效技巧
在技术研发与团队协作的日常中,知识沉淀始终是绕不开的核心命题——碎片化的文档散落在不同平台、检索时陷入“关键词陷阱”、撰写技术文档耗时费力、跨平台协作效率低下,这些痛点困扰着无数开发者与团队。直到接触到一款由AI大模型驱动的开源知识库系统,我们才真正打破知识管理的壁垒,它并非单纯的“文档容器”,而是以轻量化开源架构为基础,将大模型能力与知识管理全流程深度融合的企业级工具,无论是个人私有化技术笔记的搭建,还是团队标准化产品文档、FAQ体系的构建,都能精准适配。结合长期实操经验,这篇文章将分享实打实的使用干货与心得,帮大家避开误区、高效落地。
|
3月前
|
人工智能 自然语言处理 监控
开源生态构建:从6个GitHub仓库到金融AI工具链
开源金融AI技能库:56个场景全覆盖 实战代码:基于 financial-ai-skills 项目 | 开源生态 | 场景覆盖 | 贡献指南 项目概览 `` financial-ai-skills/ ├── README.md ├── LICENSE (MIT) ├── skills/ │ ├── financial-intelligence/ # 财务智能 (8个场景) │ ├──
|
5月前
|
网络协议 视频直播 网络性能优化
CN2线路延迟原因深度解析 看完秒懂卡顿根源
作为高品质骨干网络,CN2线路凭借低丢包、高稳定的优势,成为跨境数据传输、海外业务访问的核心选择,广泛应用于金融交易、跨境电商、视频直播等对延迟敏感的场景。但很多用户在使用过程中,仍会遇到延迟波动、卡顿等问题,影响业务体验。其实CN2线路延迟并非偶然,背后往往是多种因素共同作用的结果,今天就为大家全面拆解CN2线路延迟的核心原因,帮你精准定位问题、规避隐患。
|
4月前
|
运维 算法 前端开发
用办公Agent实现智能工单:从客服请求到指派工程师的端到端自动化
本文介绍如何用办公Agent实现智能工单端到端自动化:从用户提问→自动创建/分类→智能派单→通知工程师→闭环反馈,将平均响应时间从47分钟压缩至90秒。详解5步流程、规则+LLM双分类、实时负载+技能匹配派单等核心设计,并分享避坑指南与落地路径。(239字)
636 0
|
4月前
|
人工智能 前端开发 数据可视化
向量空间JBoltAI v4.4:ReAct推理链走向全透明
向量空间JBoltAI v4.4聚焦“可解释性”痛点,重构Agent架构:拆分AgentRAG与DataChatChain,统一推理基座;新增实时推理可视化(Thought/Action/Observation),全程可追溯;强化图表生成、安全认证与SDK模型生态。让AI从黑盒走向透明、可信、可管可控。(239字)
193 0
|
5月前
|
人工智能 UED C++
短视频能做GEO不?我拍了好多产品视频,咋让AI推荐呢?
短视频可做GEO,关键在“文案即内容”:AI主要识别字幕、标题、描述等文字信息。需优化语音解说+字幕+结构化脚本(问题→解答→总结),标题含用户问题,描述详尽200字以上,并做系列化内容矩阵。视频与图文互补,提升AI识别与用户体验。

热门文章

最新文章