受众与商业目标
先定平台、画幅、单集时长和更新频率。再选题材:逆袭、悬疑、情感、修仙或知识剧情。
每一步都要留下可复用的“资产”,而不是只留最终视频。角色图、场景图、镜头表、声音和提示词库共同决定下一集能不能稳定复刻。
先定平台、画幅、单集时长和更新频率。再选题材:逆袭、悬疑、情感、修仙或知识剧情。
按“冷开场—冲突升级—小兑现—强钩子”组织。台词短、动作可视化,避免旁白代替剧情。
锁定脸型、发型、服装、色板、年龄和禁改项;为高频场景建立日/夜/雨等状态。
先用静态分镜解决叙事,再做动态。每镜只表达一个动作或情绪,标注景别、机位和时长。
以角色参考图、风格参考图和场景锚点生成首尾帧。优先修脸、手、道具和空间关系。
从低成本预演到高质量重算。用动作、速度、镜头运动和“不发生什么”控制单镜。
角色建立固定音色、语速和情绪范围。对白先行剪辑,再铺环境声、动作声和音乐。
检查连续性、口型、字幕安全区与响度。首 3 秒给冲突,结尾留可被一句话复述的悬念。
按漫剧生产真正关心的维度比较:角色一致性、动态质量、镜头控制、原生声音、中文易用性与自动化能力。星级为编辑性建议,不是统一实验室排名。
| 模型 / 平台 | 类型 | 最适合 | 一致性 | 动态 / 控制 | 声音 | 使用建议 |
|---|---|---|---|---|---|---|
| 可灵 3.0 / Omni | 视频国内 | 动作、中文叙事、多镜头 | ★★★★★ | 高 / 高 | 原生音频 | 综合型主力;主体与音色管理适合系列化。 |
| Google Veo 3.1 / Flow | 视频海外 | 电影感、物理、音画一体 | ★★★★★ | 高 / 很高 | 原生音频 | 支持参考、首尾帧、扩展、对象编辑与 4K。 |
| Runway Gen-4.5 | 视频海外 | 可控创作、编辑、商业片 | ★★★★☆ | 高 / 很高 | 支持 | 工具链成熟;适合镜头迭代、编辑和团队协作。 |
| 即梦 / Seedance | 视频国内 | 中文创作、漫剧、快速迭代 | ★★★★☆ | 高 / 中高 | 视版本 | 门槛低、中文生态顺,适合个人与小团队。 |
| 海螺 Hailuo 2.3 | 视频国内 | 人物动作、风格表现、批量 | ★★★★☆ | 高 / 中 | 配套语音 | Fast 适合批量预演,标准模型用于保留镜头。 |
| Luma Ray / Dream Machine | 视频 | 快速探索、修改现有视频 | ★★★★☆ | 高 / 高 | 配套 | 适合气氛镜头、首尾帧与视频修改。 |
| Pika | 视频 | 创意特效、社媒片段 | ★★★☆☆ | 中 / 中 | 配套 | 上手快;不建议独自承担长篇连续叙事。 |
| Midjourney V7 | 图像 | 概念美术、风格探索 | ★★★★☆ | — / 中 | — | 审美强;先做角色和场景风格板。 |
| FLUX Kontext / FLUX.2 | 图像API | 参考图编辑、自动化、本地生态 | ★★★★★ | — / 很高 | — | 适合批量角色换景、局部修改与节点化生产。 |
| Ideogram 3.0 | 图像 | 文字、海报、封面 | ★★★☆☆ | — / 高 | — | 标题文字突出;角色连续性需额外方案。 |
| Gemini Image | 图像多模态 | 指令编辑、多图参考 | ★★★★★ | — / 很高 | — | 适合连续改图与资产清理。 |
| ComfyUI | 工作流开源 | 私有化、批量、精细控制 | 取决于模型 | 很高 | 可接入 | 学习成本高,但可复现、可排队、可组合。 |
能力会随版本与地区变化。商业价格不写死,以避免快速过期;投产前请查官方页面。
即梦/可灵完成图与视频,剪映做后期。先验证题材。
两家视频主力 + 一家备选,统一剪辑模板和音色库。
Veo / Runway / 可灵承担核心镜头;先做 Animatic。
ComfyUI + API + 资产库,记录模型、种子与版本。
最贵的不是一次生成,而是模糊的分镜导致反复抽卡。把成本拆到镜头级,才能知道该在哪些镜头升级模型。
好提示词不是堆形容词,而是把镜头中的不确定性变成字段。复制后替换方括号内容,并保留项目固定锚点。
角色:[姓名/年龄/身份]
固定特征:[脸型/发型/瞳色]
服装锚点:[材质/颜色/配饰]
画面:半身主视图 + 全身三视图
风格:[项目统一风格]
背景:纯色,无文字,无手持物
禁止:[不可变化项][景别],[机位],[角色]位于[构图位置],正在[单一动作];表情[情绪];[场景锚点];[时段与主光];前景[元素],背景[元素];[画幅];保持角色服装与参考图一致。主体动作:[起点→过程→终点]
镜头:[固定/推/拉/摇/移/跟]
速度:[缓慢/正常/快速]
环境运动:[风/雨/布料/粒子]
表演:[视线/呼吸/微表情]
保持:脸、服装、背景结构
避免:变形、漂移、额外人物、镜头乱晃技术能生成,不等于内容能商用。把授权、素材来源和平台规则纳入制作表,比成片后补救便宜得多。
冻结角色圣经;只保留一套“母参考”,不要从生成结果无限套娃。
先看无声 Animatic。静态分镜讲不清,视频模型也补不上叙事逻辑。
按剧情功能选镜头:信息用固定,压迫用推进,揭示用横移或拉远。
预演用快速模型,入选后再高质量重算;为单镜设置最大尝试次数。
建立音色卡;环境声贯穿场景,避免每次切镜声音归零。
记录条款、素材来源与授权范围;避免未经许可复刻真人、商标角色和音乐。
优先收录厂商文档与模型卡。商业项目还应阅读最新服务条款、商用授权和隐私政策。