先划边界:这篇讲什么
视频生成的内容写了不少,先把这篇的位置说清:一键成片(编剧↔导演→并行渲染→拼接整条短片)、短剧前期资产(剧本/角色/分镜/定妆,不出成片)、提示词方法论(怎么写好一条提示词)都各自成篇过;这篇做的是单条创意片段——入口是把参考视频的手法拆开,提示词只是其中一环,几篇互相独立。
版权立场也先立住:拆手法,不搬内容。全文示例一律是通用手法描述("三段式反转结构""产品特写转场"这类),不指向任何具体作品,也不引导上传他人视频做二次生成。
问题:收藏夹里的视频,做不出来
两个真实障碍:一是收藏的是成品不是结构,每个镜头单看都简单,合起来无从下手;二是"抽卡"——行业报道反复引用一个数字:同一提示词可能出电影级镜头也可能出崩坏废片,有创作者抽 20 次才得 1 条可用素材。视频按秒计费,没想清楚就开跑,每一抽都是成本。
解法分三步:拆手法 → 定关键帧 → 图生视频。以下全部命令与数据来自 2026-08-17 实测(bailian-cli 1.4.2)。环境:Node.js 18+,npm install -g bailian-cli 后 bl auth login 登录,API Key 在控制台签发,CLI 安装文档。

第一步:把参考视频拆成三层结构
固定的拆法,任何让人停下来的短视频都能拆:
| 层 | 看什么 | 通用手法示例 |
|---|---|---|
| 镜头节奏 | 几秒一切、推还是拉 | 1 秒产品特写 → 3 秒缓推 → 定格收尾 |
| 转场 | 两个镜头靠什么衔接 | 相似构图硬切、遮挡物划过 |
| 信息密度 | 一镜一事还是一镜三事 | 悬念镜头只给半个主体 |
产出是一张可复述的"结构清单"。用 Agent 做调研的人可以让 Agent 代劳:Agent-Reach(GitHub 7 万+ 星)让 Agent 能读 YouTube、B站等平台的视频与评论区,把链接交给 Agent 按"节奏/转场/密度"输出清单即可;没装的人工拉片,结果一样。评论区值得单独看:高赞评论夸的那个瞬间就是钩子,抄"钩子位置"这个手法进清单。
第二步:先定关键帧,把决策放在便宜的环节
纯文生视频把构图、道具、色调全交给随机,这就是抽卡来源。先用图片模型定首帧:
bl image generate --prompt "Product photography: a cup of latte on a dark walnut wood table, soft side lighting, delicate steam rising, shallow depth of field" --size 16:9 --n 4
--n 4 一次出 4 张挑 1 张(上限 6),审美决策前置到秒级返回、近乎免费的图片环节;--size 直接写比例(16:9 / 9:16),与后续视频 --ratio 对齐。实测 4 张全部命中主题要求,挑构图最稳的一张。
第三步:图生视频 + 异步任务三段式
bl video generate --image <关键帧URL> --prompt "Camera slowly pushes in toward the cup, steam rising and curling softly" --ratio 16:9 --no-wait
bl video task get --task-id <任务ID>
bl video download --task-id <任务ID> --out demo.mp4
带 --image 时模型自动从文生切图生(默认模型随之切换),无需手动指定。--no-wait 立即返回任务 ID,视频生成是异步任务,提交后可继续其他工作,回头轮询状态、完成后下载。
同日同场景的对照实测:
| 路径 | 耗时 | 结果 |
|---|---|---|
| 图生(关键帧驱动) | 2 分 03 秒 | 推镜平滑、主体首尾一致,一次可用 |
| 文生(同一场景描述) | 2 分 21 秒 | 画质不差但模型自由发挥:多出碟子/台灯/咖啡馆内景,色调不符——有明确设定的产品片场景即为废片重抽 |
耗时相当,差异在命中确定性。竖版把 --ratio 换 9:16、关键帧 --size 同步换即可。

成本口径与防超支
视频调用单价显著高于文本,免费额度在视频场景消耗快。动手前先开:
bl usage freetier --all
额度用尽自动停而非静默转付费;做完用 bl usage stats 看自己账号的真实消耗——这是最可信的成本口径。免费额度真实口径(官方文档):各模型独立额度(100 万 Token 级)、90 天有效、仅华北 2(北京)、过期不补发、用尽不自动切换,网上"永久有效"说法是错的。具体单价不引用第三方数字,按秒计费、清晰度档位(720P/1080P)与时长决定单价,以官方模型页为准。
边界:这条路不适合什么
强叙事连续镜头(剧情/多镜衔接/人物一致)走不通,那是成片编排的路(一键成片那篇);长片受单次时长限制(默认 5 秒),靠分段生成加剪辑;搬运或仿制他人作品从一开始就排除在立场之外。商用前自行确认模型商用授权条款。剪辑环节互补:生成的片段是素材,接开源剪辑工具(如 8 万+ 星的 OpenCut)即可。
更多模型能力与额度入口见百炼控制台。
本文为个人实践记录,命令与耗时为 2026-08-17 实测,成本以自己账号
bl usage stats为准。