指南首页 / 案例 / 逆风翻盘 / 视频生成
示范案例 · 05

《逆风翻盘》视频生成

对白镜头的动作要小,口型要清楚;屏幕镜头只要亮屏和正确透视;多人镜头能拆就拆。

5生成段
23需要的关键帧
13对白口型镜头
4屏幕叠加镜头
先测镜头

镜 12 和镜 14

镜 12 同时有说话、手指点屏和屏幕光;镜 14 是唯一的 6 人全景。这两镜通过,其余镜头的风险都更低。

口型策略

先配音,再生成

对白先生成干声并锁定时长,再按实际秒数生成视频。模型支持音频驱动口型时上传对应干声;不支持时生成“说话中”的口型动作,后期对齐。

PROMPT FORMULA

对白镜头提示词公式

[镜头时段] 说话人 + 说话方式(语速、情绪)+ 一个小动作(推眼镜 / 抬手 / 翻稿)+ 头部幅度(基本不动)+ 视线方向 + 运镜(固定或极慢推近) 保持不变:脸、发型、眼镜、服装颜色、背景人物位置、屏幕保持空白亮屏 避免:多余人物、屏幕出现文字、手指变形、表情夸张
屏幕镜头只生成“空白亮屏”:提示词写“屏幕亮着空白浅蓝画面,没有任何文字和图形”。模型一旦在屏幕上生成假文字,后期叠加时会透出来,必须重做。
SEGMENT PROMPTS

第 1 集逐段提示词

E01-01 · 0–12 秒 · 镜 01–05

输入:镜 01–05 关键帧;对白干声 #1、#2 [0–2s] 俯拍特写,女性手握手机放在腿上,屏幕亮起空白浅色画面,拇指停住不动,手部稳定。 [2–4s] 近景,女子坐在门边椅子上,从低头看手机缓慢抬眼,下颌收紧,身体不动。 [4–7.5s] 中景固定,西装男子站在空白亮屏左边,右手握翻页器,从容地说话,左手插兜,头部轻微点动。 [7.5–9.5s] 主观视角,镜头极慢推近亮着空白浅蓝画面的大屏。 [9.5–12s] 过肩近景,戴圆框眼镜的年轻男子向后侧身,压低声音快速说话,眉头紧皱。 保持不变:各人服装和眼镜,大屏空白。避免:大屏出现文字或图表、手机出现界面元素。

E01-02 · 12–24 秒 · 镜 06–09

输入:镜 06–09 关键帧;对白干声 #3–#6 [0–3.5s] 近景固定,主位上的中年男子翻过一页纸,抬头平稳地说话,头部基本不动。 [3.5–6.5s] 近景,西装男子停顿半秒,右手食指推了一下眼镜,然后勉强笑着说话。 [6.5–9s] 中景,女子从椅子上站起,右手把手机扣在身侧,站定后开口说话,语气镇定。 [9–12s] 近景,西装男子转头看向画面右下方,笑容收起,快速说话,镜片轻微反光。 保持不变:眼镜款式、西装颜色。避免:起身时椅子变形、背景多出人物。

E01-03 · 24–37 秒 · 镜 10–14

输入:镜 10–14 关键帧;对白干声 #7、#8 [0–2s] 近景,中年男子左手抬到胸前掌心向下,简短说一句话,表情不变。 [2–4.5s] 侧面中景,女子沿着窗边会议桌匀速向画面左侧行走,镜头横向跟拍,步伐平稳。 [4.5–9.5s] 中近景,女子站在大屏右侧,右手食指点在空白亮屏中央,侧身平静说话,屏幕光照亮侧脸。 [9.5–11s] 特写,女性右手握触控笔贴着亮屏画一个圆,动作流畅。 [11–13s] 会议桌全景固定,两侧坐着的人转头互相看了一眼,其余人静止。 保持不变:所有人座位、屏幕空白。避免:全景中人物数量变化、人脸融合。

E01-04 · 37–48 秒 · 镜 15–18

输入:镜 15–18 关键帧;对白干声 #9–#11 [0–4s] 近景,女子站在大屏前,头转向画面左侧,直视对方说话,语速稳定。 [4–5.5s] 近景,中年男子眉头微压,目光转向画面右上方,说出一个名字。 [5.5–9.5s] 微仰近景,西装男子单边嘴角上扬冷笑,轻松地说话,头部轻微偏斜。 [9.5–11s] 大特写,戴婚戒的手拇指按下翻页器红色按键,干脆利落。 避免:冷笑变成双侧大笑、婚戒消失。

E01-05 · 48–58.5 秒 · 镜 19–23(镜 24 为黑场,不生成)

输入:镜 19–23 关键帧;对白干声 #12、#13 [0–2s] 正面拍摄亮着空白浅蓝画面的大屏,画面静止,亮度轻微闪一下表示切换。 [2–4.5s] 中近景,西装男子把翻页器放在会议桌上,抬眼看向画面右侧,得意地说话。 [4.5–6s] 大特写,女子眼神定住,嘴唇抿紧,脸上映着屏幕蓝光,几乎静止。 [6–7s] 前景虚化的女子低头写字,画面上方的年轻男子猛然抬头。 [7–10.5s] 近景,中年男子双手合上纸质稿,严肃地说话,停顿清楚。 保持不变:屏幕空白、各人服装。避免:合稿时纸张变形成文件夹。
SCREEN OVERLAY

屏幕内容叠加流程

按屏幕内容表逐字排版 4 块屏幕,导出 1920 × 1080(大屏)和 1080 × 2340(手机)的透明底图片。
在剪辑软件里用四角定位把图片贴到屏幕区域;镜头有推近时,逐关键帧跟踪四角。
给叠加层加 5%–10% 的屏幕反光和轻微模糊,让它和实拍质感一致。
SC03 的红圈和“27.3%”做成 1 秒手写动画,起点对齐镜 13 触控笔落下的那一帧。
暂停检查每块屏幕:错字、数字、人名和时间与剧本一致。
REWORK

返工要点

问题多发镜头原因改法
屏幕上出现乱码文字03、04、12、19模型默认给屏幕填内容关键帧阶段先修到空白亮屏;视频提示词重复“屏幕保持空白”;仍出现时整块用叠加层盖住
口型和台词节奏对不上对白镜头视频先于配音生成,时长不匹配按干声实际时长重新生成;用音频驱动口型;仍不行就改成过肩或侧脸,让口型不可见
全景里人脸融合或人数变化14多人同框超出模型稳定范围拉远到中远景并降低人物动作;只让两个人转头;仍失败就改成两个双人镜头
赵峥眼镜变成黑框或消失07、09、17近景推眼镜动作干扰关键帧里眼镜细节清晰;推眼镜动作只在镜 07 保留
周予安西装变色08、12大屏蓝光改变服装颜色提示词写“米白色西装保持不变”;调色时单独校正
起身时椅子穿模08身体与椅子遮挡关系复杂从“半起身”的关键帧开始,只生成站直的后半段
表演过火17、20“得意”“冷笑”被放大改写成“只有一边嘴角轻微上扬”,写动作而不写情绪形容词

验收清单

  • 13 个对白镜头都能看到说话动作,或已改为不露口型的机位
  • 所有屏幕在视频中保持空白亮屏,叠加后逐字核对
  • 7 人座位与座位图一致,全景中没有多人或少人
  • 眼镜:赵峥细框、陈默圆框、X1 细框、X2 方框,江总和周予安不戴
  • 记录每段的模型、提示词版本、种子和重做次数
本阶段交付5 段视频素材、4 块屏幕叠加层、选定版本清单和返工记录。方法见 第 04 章。
这页有用吗?
哪里不好?

收到,谢谢。我们会根据反馈改这一页。