本文回答:产品展示动画怎么做——几种做法各要喂进去什么、拿回来什么;AI 从商品照片生成这条路怎么把整条片写成分镜 JSON(商品朝向、运动、时长、背景、参考照片),字段怎么变成每一镜的生成任务和提示词,出片后按哪张判废表逐镜筛,以及已有三维模型时白模视频怎么接进分镜。
产品展示动画怎么做:手里有实物、要的是外观展示,常用做法是 AI 从商品照片生成——先把整条片写成一份分镜 JSON(每镜填商品朝向、运动、时长、背景、用哪几张参考照片),按字段逐镜生成,再用判废表筛掉商品变形、开场没给全貌、画面冒字的镜头,最后剪成整片;拆镜头、逐镜生成这几步也可以交给 AI 视频产线。产品还没量产或要拆开讲内部结构,走三维建模渲染;要真人上手,走实拍。
产品展示动画是以单件商品为主角、靠镜头运动和光影把外观、细节或结构交代清楚的短片,画面可以来自三维渲染、AI 生成或实拍。
产品展示动画ai怎么做?先看几种做法各吃什么、吐什么
| 做法 | 要喂进去什么 | 哪几步自己做 | 拿回来的是 |
|---|---|---|---|
| 三维建模渲染 | 设计图纸、工程模型,或按实物重建的模型 | 建模、材质、布光、动画、渲染、合成全部 | 镜头完全可控,能做拆解、剖面 |
| 白模视频 + 视频模型渲染 | 带运镜动线的简单白模视频,加商品参考图 | 摆白模动线、写提示词、挑片、剪辑 | 单段片段,质感交给模型 |
| 逐镜生成再剪 | 多角度商品照片,加每一镜的提示词 | 拆分镜、写词、逐镜生成和挑选、剪辑 | 单段片段,自己剪成整片 |
| AI 视频产线 | 商品照片,可附需求说明 | 选方案、看片、决定哪段重做 | 一条完整的片 |
| 实拍 / 外包 | 实物、场地、人;外包是脚本和预算 | 拍摄与剪辑,外包则是对接验收 | 真人上手、真实场景的片 |
下面的主线是第三行:分镜写成结构化数据再逐镜生成,某镜判废时知道改哪个字段,而不是换个说法重抽。
产品展示动画制作第一步:把整条片写成分镜 JSON
拆镜头是这条路里最费人的一步。这一步也可以交给产线自动做,比如猫斯卡(AI 视频生产系统):上传 2 到 12 张商品照片后,由分镜师、导演等数字专家出三个不同风格的方案,选中一个出整片,产品外观由照片锁定,给了 LOGO 文件的原样叠加在结尾镜上、不让模型画;它解决的是拆镜头和逐镜写词的人工,哪一段能用仍要人判断,某段不满意可以单独重做那一段。
自己做的话,以一只保温杯的外观展示片为例(本文示例,字段可增减),先给参考照片编号,再写镜头:
{
"model_version": "2.5",
"ratio": "3:4",
"text": "none",
"reference_images": [
{
"id": "图1", "view": "正面,印字朝镜头"},
{
"id": "图2", "view": "45 度侧面"},
{
"id": "图3", "view": "杯盖特写"},
{
"id": "图4", "view": "背面"}
],
"shots": [
{
"shot": 1, "purpose": "开场全貌", "mode": "first_frame", "refs": ["图1"], "facing": "正面居中", "camera": "缓慢推近", "motion": "静止", "background": "浅灰无缝背景,顶光", "duration": 5},
{
"shot": 2, "purpose": "转面", "mode": "reference", "refs": ["图1", "图2", "图4"], "facing": "正面转到侧面", "camera": "固定机位,中景", "motion": "随转台匀速转动", "background": "浅灰无缝背景,顶光", "duration": 6},
{
"shot": 3, "purpose": "细节", "mode": "reference", "refs": ["图3"], "facing": "杯盖朝上", "camera": "微距横移", "motion": "静止", "background": "浅灰无缝背景,侧光", "duration": 4},
{
"shot": 4, "purpose": "场景收尾", "mode": "reference", "refs": ["图1", "图2"], "facing": "正面", "camera": "缓慢拉远", "motion": "静止", "background": "木质书桌,窗边侧光", "duration": 5, "logo": "post_overlay"}
]
}
| 字段 | 怎么填 | 依据 |
|---|---|---|
| id | 按上传顺序编号 | 《Doubao Seedance 2.5 提示词指南》:按上传素材的顺序对应编号,每个素材进行文本绑定,不建议只在图片里呈现映射信息 |
| 第 1 镜 facing | 完整外观、商品居中 | 抖店《【商品】主图视频创建指南说明》:「商品3s内快速出镜」「商品全貌需要展示,不可全程只展示细节」 |
| camera / motion | 景别运镜直接写,动作概括写 | 同 2.5 指南:景别/运镜/机位可直接写,动作优先概括性描述 |
| shots 怎么切 | 转面、细节、收尾各占一镜 | 同 2.5 指南:复杂任务拆成多个简单任务分次生成 |
| duration | 整数,不低于接口下限 | 火山方舟《创建视频生成任务》:Seedance 2.5 取值 [4, 30] 或 -1,2.0 系列 [4, 15] 或 -1 |
| text | 默认 none,卖点字幕后期加 | 2.5 指南:负向控制支持「不要字幕」,但字幕约束目前无法完全避免 |
| logo / background | 标志后期叠加;全片光向、底色统一 | 建议(本文整理) |
分镜 JSON 怎么变成每一镜的生成任务?
一镜就是一个独立任务,按 mode 分两种:
- first_frame:图 1 直接当首帧,开场第一眼就是正面全貌。据《创建视频生成任务》,Seedance 2.5 首帧生视频只支持 ratio 为 adaptive,输出宽高比自动和首帧图片一致,所以图 1 要先裁成 3:4 再上传。
- reference:几张参考图一起喂,适合转面、细节、场景镜。同一文档写明图生视频-首帧、首尾帧、全模态参考生视频是 3 种互斥场景,不可混用;全模态参考也能用提示词指定参考图作首帧 / 尾帧间接实现,但要严格一致优先用首帧那种。每镜只填一个 mode。
reference 镜的提示词按 2.5 指南的基础写法拼:素材指代 → 一句话概述 → 具体情节 → 结尾(机位/运镜、环境/场景、声音、氛围)。refs 进素材指代,purpose、facing 进概述,motion 进情节,camera、background、text 进结尾。第 2 镜拼出来是这样(本文示例):
图1是保温杯正面,图2是同一只保温杯的45度侧面,图4是它的背面。
一只哑光白色保温杯放在白色转台上,产品展示,写实风格。
保温杯随转台匀速转动,从正面转到侧面,杯身外形和印字与图1、图2、图4一致。
固定机位,中景,浅灰无缝背景,顶光柔和。无 bgm,只生成环境音和动作音。不要字幕。
照片已经把外形交代清楚,概述里就不再复述杯子长什么样:2.5 指南的说法是参考素材已足够精准时只做「指代」、减少画面复述。
产品展示动画视频出片后怎么判废?逐镜判废表
每一镜先过这张表,任一项不合格就判废、不进剪辑:
| 检查项 | 判废信号 | 依据 |
|---|---|---|
| 商品外形 | 杯身比例变了、杯盖多出或少了部件 | 抖店指南「人或主图商品无畸变情况」「商品需与商品详情为同款商品」 |
| 印字和标志 | 字母错乱、印字糊成花纹 | 本文整理 |
| 开场 | 第 1 镜开头是局部特写或空镜 | 抖店指南「商品3s内快速出镜」 |
| 全片构成 | 剪完只剩特写 | 抖店指南「商品全貌需要展示,不可全程只展示细节」 |
| 商品数 | 背景里冒出第二只杯子 | 抖店指南「除服饰、珠宝类目外,视频只出现核心售卖单商品」 |
| 画面文字 | 冒出字幕或乱码 | 2.5 指南:字幕约束目前无法完全避免 |
| 画质 | 光斑、噪点,连续卡顿抖动,过明过暗 | 抖店指南「无影响观看体验的光斑、噪点」「无连续出现多处卡顿和抖动」「画面无过明过暗」 |
| 镜与镜之间 | 前一镜冷调、下一镜暖调 | 本文整理;2.5 指南提醒 2.5 与 2.0 美学风格偏好差异较大,混用输出风格不连贯 |
判废后改哪个字段(本文整理):
- 外形走样:
motion幅度是不是太大,转面拆成两镜;refs缺这个角度的照片就补拍。 - 印字乱掉:这一镜避开印字那一面,或
logo改后期叠加。 - 冒字:确认结尾写了「不要字幕」,仍出现就重生成或剪掉那几帧。
- 镜间不连贯:
model_version锁死,全片同一版本;background的光向写成同一句。 - 开场不合格:第 1 镜改用 first_frame,图 1 换成正面全貌照。
3d产品展示动画怎么做?已有模型时,白模视频怎么接进分镜
传统三维流程是建模、材质、布光、动画、渲染、合成,拆解、剖面、零件归位这类画面只有它能做。
已有三维模型、又不想把材质和渲染做满的,可以只出一段简单白模视频交给视频模型渲染。据《Doubao Seedance 2.5 提示词指南》,Seedance 2.5 支持输入含有运动、运镜、动线和光照等动态 / 时序信息的白模视频进行渲染,还支持叠加输入主体、场景和道具等参考图;同时写明当前版本对于简单建模的参考效果较好,建议仅用简单几何体拼接。这是 2.5 版本的说法,换版本以对应文档为准。
接进 JSON 时,在那一镜的 refs 里加一个「视频1」(白模视频),mode 仍是 reference。实操上,白模管「怎么动、机位在哪」,外形和质感仍靠商品照片;要讲内部结构、零件装配的镜头,简单几何体表达不了,还是走完整三维渲染。
常见问题
分镜 JSON 里的 duration,每镜填多少合适?
先看两头:接口一头,据《创建视频生成任务》,Seedance 2.5 取值 [4, 30] 或 -1,2.0 系列 [4, 15] 或 -1,并提醒「视频时长与计费相关,请谨慎设置」;发布一头,抖店主图视频指南写「5秒<=时长<=60秒,建议30秒内」,各镜加起来别超出。中间怎么分,实操上按「一镜只讲一件事」,先按下限试,看片不够再加。
同一份 JSON 想出抖店和淘宝两个版本,ratio 填哪个?
抖店主图视频指南写支持 1:1、3:4 或 9:16;淘宝官方运营账号发布的《【质量分】淘宝天猫素材规则描述》把「缺少视频(1:1、16:9、3:4有一个即可)」列为素材问题。两边都有的是 1:1 和 3:4,实操上可按其中一个出一版两用,以各自发布页为准。改了 ratio,first_frame 那一镜的首帧图也要按新比例重裁。