本文回答:一条 15 秒的 AI 产品广告怎么按秒写成时间轴 JSON(起止时间、景别、运镜、主光方向、转场),时间轴里的秒数怎么变成生成参数和剪辑入点,每一镜的提示词怎么从字段拼出来,以及光、镜头、节奏三项质感怎么逐条验收。
一条 15 秒的 ai产品广告,先把镜头按秒排成一条时间轴:每镜写起止时间、景别、一种运镜、主光方向和转场;再逐镜生成,按时间轴剪。时长在生成参数里设,不写进提示词,切点在剪辑里落。质感按三项验收:光看明暗和各镜光向是否一致,镜头看一镜一运镜、商品不畸变,节奏看 3 秒内出镜、全貌不被特写盖过。逐镜生成再剪、画布工作流、AI 视频产线、实拍外包几类做法,这条时间轴和验收表都用得上。
产品广告时间轴是把一条广告按时间顺序拆成镜头、每镜写明起止时间和拍法的结构化脚本,能直接对着剪辑软件的时间线落。
ai产品广告怎么做?先写一条按秒排的时间轴
总长定 15 秒:淘宝开放平台《短视频发布指南》对主图视频写「建议15S,最长不超过60S」,抖店《【商品】主图视频创建指南说明》写「5秒<=时长<=60秒,建议30秒内」,15 秒落在两家的范围里,具体以发布页为准。抖店同一份指南还要求「3s 内快速出镜」「展示全貌不可全程只展示细节」「除服饰珠宝类目外只出现核心售卖单商品」,所以第 1 镜从第 0 帧起给全貌,特写和材质两镜加起来不超过全貌镜头的总长。
时间轴写完,手工做法是逐镜写提示词、逐镜生成、按帧剪辑,后面两节分开讲。这几步也可以整段交给产线做,比如猫斯卡(AI 视频生产系统):上传 2 到 12 张商品照片,镜头按它给出的方案排、不是照这条时间轴逐秒执行,产品外观由照片锁定,给了 LOGO 文件的原样叠加在结尾镜上、不让模型画,某段不满意可以单独重做那一段、其余不动;它解决的是逐镜写提示词和产品外观走样,成片是画面加配乐,卖点字幕要在剪辑软件里加,哪一段该重做仍要人对着后文的验收表判断。
下面以一副白色无线耳机(充电盒加两只耳机)为例,是本文示例,不是平台规定。帧号按 24 帧计(火山方舟《创建视频生成任务》示例返回里 doubao-seedance-2-0 任务的帧率是 24):
{
"product": "白色无线耳机", "total": 15, "fps": 24, "model": "五镜同一个模型",
"shots": [
{
"id": 1, "t": [0, 3], "frames": [0, 72], "gen_duration": 4, "use_in": 0,
"size": "中景", "move": "缓慢推近", "key_light": "左后侧逆光勾轮廓",
"state": "盒盖合上,居画面中心", "transition_out": "硬切", "check": ["L1", "R1"]},
{
"id": 2, "t": [3, 5.5], "frames": [72, 132], "gen_duration": 4, "use_in": 0.5,
"size": "特写", "move": "固定机位", "key_light": "左后侧逆光,正面柔光补暗部",
"state": "盒盖缓慢打开,露出两只耳机", "transition_out": "硬切", "check": ["C2", "L2"]},
{
"id": 3, "t": [5.5, 8], "frames": [132, 192], "gen_duration": 4, "use_in": 1,
"size": "微距", "move": "固定机位", "key_light": "窄光从左后方扫到右侧",
"state": "外壳哑光纹理与接缝,商品不动", "transition_out": "硬切", "check": ["C2", "L3"]},
{
"id": 4, "t": [8, 11.5], "frames": [192, 276], "gen_duration": 4, "use_in": 0.5,
"size": "中近景", "move": "固定机位", "key_light": "窗光从左侧进",
"state": "一只手从木桌上慢慢拿起一只耳机", "transition_out": "叠化", "check": ["C4", "L2"]},
{
"id": 5, "t": [11.5, 15], "frames": [276, 360], "gen_duration": 4, "use_in": 0.5,
"size": "中景", "move": "缓慢拉远", "key_light": "回到第 1 镜光型",
"state": "盒子回到画面中心,右侧留 LOGO 位", "transition_out": "片尾淡出", "check": ["R4"]}
]
}
t 是这一镜在成片里的起止时间,gen_duration 是交给模型的生成时长,use_in 是从生成片段的第几秒开始取用;move 每镜只填一个值;check 指向后文验收表的编号。转场是建议写法。
时间轴里的秒数怎么交给模型?时长参数和剪辑入点分开管
第 2、3 镜只有 2.5 秒,模型不收这么短的时长。火山方舟《创建视频生成任务》的 duration 取值:Seedance 2.0 系列为 [4, 15] 或 -1,Seedance 2.5 为 [4, 30] 或 -1(-1 是智能选择)。所以每镜 gen_duration 填 4,多出来的靠 use_in 和 t 在剪辑里裁掉。
时长也不进提示词。火山方舟 Seedance 2.5 提示词规范(sd25-pe)写明「画幅、总时长、分辨率、帧率和声音开关不写进 Prompt。普通生成任务由页面或接口设置这些参数」。t、frames、gen_duration 三个字段都只给参数和剪辑用。
火山方舟《创建视频生成任务》还说明,查询接口返回的 duration 是时长约数(整数秒),等于实际总帧数除以 24 向下取整,可能与实际时长不同;剪辑时以实际帧数对 frames。
ai产品视频怎么制作:每一镜的提示词怎么从时间轴字段拼出来?
先备参考照片,拍摄只负责输入:合盖、开盖、接缝细节各一张。《Doubao Seedance 2.0 系列教程》写全模态参考输入图片 0~9 张。反光重的,耐司说明写「非金属表面的反光属于偏振光,金属表面的反光则不属于偏振光」,非金属外壳可以试偏振镜,金属件只能调灯位。
再按《Doubao Seedance 2.5 提示词指南》的四段结构(素材指代、一句话概述、具体情节描述、结尾)填字段。第 3 镜的模板,花括号是 JSON 字段:
【素材指代】图片1 是{product}的接缝细节照,只用于锁定商品外观;图片2 只采用光线,不采用图中物品。
【一句话概述】{product}静置在深色木桌上,产品广告风格。
【具体情节】镜头1:{size},{move},{key_light},{state}。
【结尾】环境安静。不要字幕,无 bgm,只生成环境音。
- 「只采用光线」照 sd25-pe 的示例「<场景A>参考@图片4,只采用空间布局、建筑和光线,不采用图中人物」;五镜挂同一张光线参考图对齐光向是本文的办法。
- 2.5 指南说参考素材已足够精准时只做「指代」、减少画面复述,所以模板不用文字描外观。
move只填一个值,对应 Seedance 2.0 系列提示词指南「一个镜头里尽量只指定 1 种运镜方式,不要同时要求推拉摇移」。- 第 4 镜有手部动作,sd2-pe 要求「优先低缓连续小动作,规避狂奔/大跳/剧烈翻滚等高爆发动态」,所以写「慢慢拿起」。
换 2.0 模型时,sd2-pe 写明「最终输出必须包含画质包 + 稳定包 + 水印 / Logo 兜底」,「字幕兜底(非文字生成任务必挂)」,多人场景还要挂双胞胎兜底。2.5 反过来,sd25-pe 写明不得自动添加用户未要求的画质包、稳定包、水印、Logo、字幕等约束,所以 2.5 模板只留「不要字幕」这类明确要的。商品本身印着标识的,挂了 Logo 兜底后建议逐镜核对标识还在不在。
产品广告片的质感怎么验收?光、镜头、节奏判定表
每生成一段,放进时间线和前后镜头连着看。「依据」列注明出处;「判据」「不合格长什么样」两列是本文整理。
| 编号 | 判据 | 不合格长什么样 | 依据 |
|---|---|---|---|
| L1 明暗 | 暗部看得清,高光不糊 | 盒身暗面黑成一块 | 抖店「画面无过明过暗」「无影响观看体验的光斑、噪点」 |
| L2 光向 | 五镜主光同一侧 | 剪在一起像两套片 | 本文整理 |
| L3 风格 | 质感和前后镜一致 | 某一镜像塑料或 CG | 2.0 指南:加明确风格约束词;2.5 指南:2.5 与 2.0 混用风格不连贯 |
| C1 运镜 | 一镜一种运镜 | 推着又摇,边缘发虚 | 2.0 指南 |
| C2 外形 | 弧度、接缝和照片对得上 | 盒盖变厚、接缝挪位 | 抖店「人或主图商品无畸变」 |
| C3 视角 | 商品完整、水平 | 切边或歪斜 | 京东《主图视频操作手册》「请保持产品完整出现在可见区域内,保持水平视角」(投京东时) |
| C4 动作 | 手部慢而连续 | 耳机凭空换位 | sd2-pe「优先低缓连续小动作」 |
| R1 出镜 | 3 秒内出镜 | 先给空镜再出商品 | 抖店「3s 内快速出镜」 |
| R2 全貌 | 全貌镜头总长不少于特写加材质 | 全片都是局部 | 抖店「展示全貌不可全程只展示细节」 |
| R3 切点 | 切在动作完成后 | 盒盖开到一半切走 | 本文整理(建议) |
| R4 片尾 | 结尾干净、声音收住 | 片尾杂音或冒出别家水印 | 2.0 指南:片尾音频淡出;出现其他平台 Logo / 水印时加「不要生成水印」 |
外形类(C2)回去换更清楚的参考照片;光和风格类(L2、L3)先统一光线参考图和模型;节奏类(R1 到 R3)多半不用重生成,改 use_in 和切点就行。
产品广告片制作流程:从时间轴到导出要过哪几道关?
- 写时间轴:五镜
t首尾相接到 15,每镜一个move,参考照片已拍好。 - 设参数:
gen_duration、画幅在页面或接口里设,五镜同一个模型。 - 拼提示词并逐镜验收:过 L、C 两组,不合格只重做那一镜。
- 按帧剪辑:对
frames,过 R 组;配乐、卖点字幕、LOGO 在剪辑里加。 - 发布前对规则:发抖音电商的,《抖音电商人工智能生成内容管理规则》3.3 规定采用人工智能发布视频内容的「需在相关直播间、视频页面进行显著标识」;3.4 规定商家采用人工智能生成商品信息的,「商品头图(主图第一张)、SKU图、商品视频必须展示商品实物图」。
常见问题
五个镜头能不能一次生成 15 秒,省掉剪辑?
可以试,但时间轴就从切点变成了预算。Seedance 2.0 系列提示词指南要求按「镜头1、镜头2、镜头3」的事件顺序组织,并说明模型对精确时间的支持不稳定;2.5 指南写明 2.5 响应整数秒时间戳、2.0 只响应镜头序号,按这条,2.5 秒这种非整数切点没法用时间戳写;Seedance 2.5 提示词撰写指南还提醒,时间段是时间预算,动作可能在边界附近提前或延后。2.5 指南同时建议复杂任务拆成多个简单任务分次生成,要卡准时间轴还是逐镜生成再剪。
转场写进提示词,还是在剪辑里做?
逐镜生成的,在剪辑里做,transition_out 就是给剪辑看的。只有几镜放进一次生成时才写进提示词:Seedance 2.5 提示词撰写指南说普通叙事优先用「阶段」,关键交接、进出场、转场才用时间点。