跳到正文

用万镜一刻画布做短剧:从分镜表到成片的完整实操指南

讲师 小歪 · 20:00 直播

2026 年 5 月 29 日,WaytoAGI 视频板块主理人小歪在阿里云 AI 创享日专场中,用万镜一刻平台的画布功能完整演示了 AI 短剧的制作流程。这场分享适合想用 AI 做短剧、但还没跑通全流程的创作者,也适合已经在做但总被角色不一致、背景污染、抽卡率高等问题困扰的人。小歪从剧本拆解、角色与场景准备,到单镜头视频生成、素材微调,再到 HappyHorse 1.0 模型的能力展示,把每一步的「为什么这么做」和「具体怎么操作」都讲透了。

前置准备:分镜表、角色、场景、道具

小歪强调,做短剧的第一步不是打开工具生成视频,而是把前置工作做扎实。她总结为两件事:拆好分镜表,备好角色、场景和道具。

分镜表是整条制作流程的「总纲」。 小歪说,分镜表要明确「你的片子有多少个镜头?每个镜头是什么东西?」它不仅是制作时的参照,也是多人协作时跟踪进度的工具——每个镜头做到哪一步、有没有定稿,都能在表里一目了然。她建议在分镜表上预留一列,用来放每个镜头最终定稿的视频。

角色准备是重中之重。 小歪特别提醒:同一个角色如果有不同形态,一定要在前期就把每种形态单独拎出来,分别准备绘图提示词。她举例说,自己演示的短剧里有个叫林远的角色,分为凡人和神明两种形态,这两种形态的提示词都要提前写好。这样做的原因是短剧往往涉及多人协作,「你做了前几集,其他人要做后几集,其他人在做后几集这个角色的另外一种形态的时候,他再要去调图,要保持角色的一致性,他发现你前面做前几集的那个人,他就只生成了一种图……他就要重新来」。

生成角色定稿图时,小歪给出了几条具体建议:

  • 先出单张正面全身照,不要一上来就生成三视图。 因为调角色穿搭需要反复改,三视图每次修改都要同时处理三个视角,细节容易顾此失彼。等正面全身照调到满意了,再基于它生成三视图,抽卡次数会少很多。
  • 提示词要写清楚:正面全身照、纯白背景、无表情,包含性别、年龄层、五官、发型、服装、鞋。 鞋的描述很关键——如果不写鞋,模型有一定概率只生成到脚踝以上的半身照;写了鞋,模型为了画出鞋,就会把整个人从头到脚完整呈现。同时,鞋的细节也有助于后续生视频时保持主体一致性,避免同一条视频里鞋子变来变去。
  • 定稿图不要带特定表情。 小歪解释,如果拿角色疲惫、皱眉的状态做定稿图,后面生成正常状态的镜头时,黑眼圈和皱眉会一直「污染」下去。
  • 服装配饰能简就简。 「你的细节越多,尤其是无关紧要的细节……你越到后面是越难保持它的一致性的。」但如果配饰是剧情必需的,再复杂也得做。

道具图同样要求纯白背景。 小歪提醒,用 AI 拆剧本时,它生成的道具提示词往往会写成「一个人拿着什么道具」,这种描述会把人物污染进道具图里。道具尺寸按形状选:普通道具选 1:1,竖向长条选 9:16,横向长条选 16:9。

场景图要做到「无人物、无天气」。 小歪说,场景图只要最基本的场景描述,不要出现关键人物,也不要写夜晚、暴雨这类天气信息。「你出一个最简单的……没有任何天气描述的一个城市的长相,它就可黑可暗可白可下雨可天晴可下雪」,后面任何天气变化都可以通过视频提示词加进去,可塑性和自由度更高,也不会产生污染。

在画布中生成角色、道具与场景图

前置准备做完,就可以在万镜一刻的画布中实际操作了。小歪演示了完整的操作路径。

生成角色正面全身照: 在画布中右键新建图片节点,把准备好的绘图提示词粘贴进去,尺寸选 9:16,模型用默认的万象 2.7,点击生成即可。

从全身照生成三视图: 从已生成的全身照节点拉出一根线,新建图片节点,输入框上方会自动带上这张参考图。提示词写「根据这张图,从左至右依次排开正视图、侧视图、背面视图以及面部特写,保持一致性」。尺寸要选横版(16:9 或更大),不能再用竖版。如果角色服饰特别复杂、横向装饰多,建议选更宽的尺寸,避免三视图之间出现重叠。

生成同一角色的不同形态: 小歪强调,不要直接复制提示词重新生成,而是「拿前面生成好的这个图作为参考」,把提示词改成「把图片中的人物变成某某形象」,这样能在锁定长相的前提下换装。她特别提醒:参考连线时要用正面全身照去改,不要用三视图去改,因为「你去单调一个角度的图,会比调多个角度的图要简单很多,抽卡率会降低」。

保存资产: 定稿后的图可以点「添加到资产」,之后在画布的资产下拉菜单里随时调用。也可以把图「存为主体」,平台会自动生成三视图。小歪建议,如果要在不同画布之间串用角色,最好存成资产,方便后续调用和衍生。

道具和场景图: 道具提示词同样要求纯白背景,尺寸按道具形状选。场景图尺寸选 16:9,提示词里不要带天气和人物。

小歪还分享了一个解决道具大小不协调的技巧:如果道具图放到画面里显得过大,可以在参考图上用蒙版框出一个小区域,把道具限定在那个范围内,生成时道具就会按区域大小呈现。这个方法同样适用于控制两个人的身高比例——在分镜图上框出大小不同的两个区域,分别指定放哪个人。

参考主体生视频:省掉分镜图环节

资产准备好之后,就进入最核心的环节——生成单镜头视频。小歪说,有了参考主体生视频功能,以前「先生成分镜图、再图生视频」的中间步骤可以省掉了,直接把角色、场景、道具图作为参考,写一段视频提示词就能生成单镜头视频。

具体操作:在画布中把该镜头需要的参考图节点拉线连到视频节点,选择「参考生视频」,把提前写好的视频提示词粘贴进去。小歪特别强调,提示词里要准确 @ 对应的参考图——点击输入框里的 @ 符号,会自动列出当前引用的所有图片。如果一条视频里参考的主体多、形态多,最好每个关键位置都 @ 一次,避免模型混淆。「你像这种,你就最好是每个都给我弄出来,你就每个出现那什么玩意的时候,都把它 at 一下,这样子自己也不会弄混,然后模型也不会弄混。」

她建议在制作前就把每个镜头要引用的资产和视频提示词整理好,对应分镜表逐条制作。给图片节点命名也很重要——把「凡人林远」「至高神林远」这类名字改好,后面 @ 的时候一目了然,不会出现「@ 图片 6、@ 图片 1」这种不知道谁是谁的情况。

小歪用 5 个镜头演示了完整流程:第一个镜头是林远在都市街道奔跑,引用「打工人林远」和「现代街道」两张图;第二个镜头要穿越,引用「打工人林远」加现代和古代两个场景;后面变身、成王、拿道具等镜头,分别引用对应的形态和道具图。每个镜头都是「拉图、写提示词、生成」三步。

素材微调:图片与视频的细节处理

单镜头视频生成后,往往需要微调。小歪把微调分为图片和视频两部分,逐一演示了万镜一刻画布中的功能。

图片微调:

  • 局部重绘: 框选图片的某个区域,写提示词重新生成。可以换衣服颜色、改发色、换道具材质,甚至把沙发换成椅子。小歪演示了框选外套区域改颜色的操作。
  • 提升画质: 生图时直接选 1K、2K 或 4K 分辨率,尽量避免生成后再高清化。「你对同一张图调整的越多,这一张图的原本的一些细节就越容易丢失。」
  • 多视角: 选中图片后点「多视角」,通过拖拽调整视角方向,可以精确控制旋转角度。小歪演示了把场景图转到左侧 60%,生成了完全不同的画面角度。她建议,如果多个镜头引用同一场景导致第一帧雷同,可以用多视角换角度,让画面更丰富。人物分镜图同样可以用这个功能调整角度。
  • 灯光调整: 选中图片后点「灯光」,可以调整光源角度(横向和竖向两个轴)、光源方向和光源颜色。小歪说,这个功能对电商场景尤其有用——模特穿自家服装生成图片或视频时,打光与不打光效果差异很大。
  • 多宫格裁剪: 生成九宫格、十六宫格或二十五宫格的故事板后,点「多宫格」可以一键拆成单张图,方便逐张优化后再生成视频。小歪演示了两种生成宫格图的方式:一种在提示词里写清楚每个格子的内容,另一种只给大概梗概让模型自由发挥。
  • 裁剪: 把图片裁成 1:1、4:3 等不同比例。

视频微调:

  • 超分: 提升视频分辨率。
  • 选帧: 选中视频中的某一帧,一键保存为静态图,自动存入画布,可作为分镜图用于后续图生视频。
  • 去字幕: 视频中出现多余字幕时,框选字幕区域即可抹除。也支持导入本地视频后去字幕。
  • 剪辑: 裁剪视频中多余的部分。小歪演示了把一段视频前面几秒角色呆站的部分裁掉,让视频一上来就进入劈雷穿越的情节。她提到,剪辑功能不消耗积分。

HappyHorse 1.0 模型能力与提示词技巧

小歪用大量案例展示了 HappyHorse 1.0 的模型能力,并穿插讲解了提示词的使用技巧。

模型能力:

  • 文生视频: 展示了布料丝绸的飘动、积水上的反射光与水花、咖啡拉花、人物情绪表达、正反打对话等效果。小歪说,正反打镜头只要在提示词里写清楚两个人的站位、左右位置和台词即可,不用写得很复杂。
  • 图生视频: 以一张图作为首帧继续演绎,如天变黑、跳舞、跑车等。
  • 参考主体生视频: 除了短剧场景,还可以做电商——把商品图丢进去,描述它要置于什么场景,就能生成商品展示视频。小歪还测试了特殊身体特征的保持:一只蓝瞳一只黄瞳的猫,多角度切换后瞳色依然准确。
  • 视频编辑: 这是小歪重点展示的能力,包括:
    • 环境替换: 把原视频中沙漠徒步的背景换成大海,人物的每个镜头、动作都不变。
    • 风格转换: 把写实风格的城市街道换成漫画风。
    • 道具和妆造替换: 把穿西装喝咖啡的人,换成古装、杯子换成青铜酒器,喝咖啡的动作和节奏完全不变。
    • 服装替换: 把原视频模特的衣服换成自己的服装图,人物和构图不变。
    • 视听调整: 把晴天跑步的视频改成乌云密布,并加上打雷的声音。小歪说,视频编辑不仅改视觉内容,听觉内容也可以调整。
  • 叙事能力: 展示了多级动作连贯(酷跑、拔刀、上马、骑)、一镜到底等能力。

小歪提醒,视频编辑时可以添加多张参考图,但要注意个数限制——「你在原视频上要改动的元素过多的话,它的生成内容就会比较差」。

提示词技巧:

  • 检查 AI 生成的提示词: 不要直接复制 AI 生成的视频提示词就跑,要先通读检查。重点看有没有太文艺、太抽象的描述(如「梨花带雨」「口若悬河」),这类词模型理解不了,还可能产生奇怪的污染;有没有重复的废话,提示词越长模型越容易找不到重点。「尽量是你的提示词越精简、越重点就越好。」
  • 中英混合的使用场景: 不是所有情况都适合中英混合。当某个特定概念(如「微焦距」「九宫格布局」)用中文描述效果不好时,可以在描述后面加括号写上英文词,如 grid layoutstoryboard
  • 台词避免特殊字符: 写台词时,特殊符号和阿拉伯数字可能导致模型读错。小歪举例:写「贝塔面霜」的符号,模型读成了「B 面霜」;写「1299 元」的符号,模型读成「1299.0」。改成中文写法后读音就准确了。
  • 用同音字解决读音问题: 如果模型读不出某个字(如「灰烬」的「烬」),可以用同音字代替(如「镜头」的「镜」)。「用相近音里面最简单的字啊,别到时候你用相近音又弄一个特别复杂的字,他有可能也会读错。」
  • 时间线写法: 当单镜头视频很长、承载内容多且有先后顺序时,可以用「0 秒到 3 秒干什么、3 秒到 5 秒干什么」的时间戳写法来锁定时间分配。简单的 5 秒单镜头不需要这样写。
  • 先看模型文档: 小歪反复强调,使用任何模型前先看它的官方指南。HappyHorse 的指南里写了提示词书写规范、台词长度上限(如 5 秒视频的中英文台词上限)、时长与内容匹配建议、镜头语言术语对照表等。「你包括他的指南里面,甚至把什么镜头语言和进阶技巧都给我们写在这里了。」

现场问答

两个不同身高的人,生图或生视频时身高差异会不会体现不出来?

很有可能。如果想把身高差异明确呈现出来,建议先生成包含两个人的分镜图,再图生视频。在分镜图上用蒙版框出大小不同的两个区域,分别指定放哪个人,就能锁定两个人的大小关系。

分镜表什么时候用?

分镜表是贯穿整个制作流程的「总表」,相当于工作篮。它用来规整流程、跟踪进度,尤其在多人协作时,每个人都能看到每个镜头的制作状态。生成好的视频也可以回填到表里。

视频提示词需要写时间线吗?

看情况。如果单镜头视频很长(如 15 秒)、承载内容多且有先后顺序,第一次生成后发现时间分配不合理(前面静态太久、后面动作太赶),就需要用时间戳写法锁定「几秒到几秒干什么」。简单的 5 秒单镜头不需要。

分镜图脸部有斑点和油腻感怎么解决?

斑点可以用消除笔抹除。油腻感要在生成分镜图时通过提示词提高真实感。关键还是前期把分镜图调整好,因为原始素材的精准度直接影响后面生视频的抽卡率。

打斗这类细节动作不会写怎么办?

把问题丢给 AI。把两个角色的图贴给 AI,告诉它「我要制作一条视频,是这两个人打斗,我知道 A 打赢了,大概打了多长时间,打斗细节我不会描述,你给我生成视频提示词」。拿到提示词后按前面说的检查方法过一遍,再丢到模型里跑。

背景人群有重复怎么办?

在提示词里要求生成不同性别、不同长相的人,或者多提供几种人物参考图。群演长得一模一样确实存在一定的抽卡概率。

多个单镜头视频怎么拼接?

用剪辑工具拼接。万镜一刻平台自带在线剪辑功能,可以把生成好的素材从资产中导入,支持智能配音、字幕、贴纸、滤镜、转场、特效等。也可以把素材导出后用专门的剪辑软件处理。

要点回顾

  • 做短剧前先拆好分镜表,明确每个镜头的内容和所需资产;同一角色的不同形态要分别准备绘图提示词。
  • 角色定稿图要求:正面全身照、纯白背景、无表情,提示词包含性别、年龄、五官、发型、服装、鞋;先调好正面全身照再生成三视图。
  • 道具图要纯白背景、无人物,尺寸按形状选(普通 1:1,竖向 9:16,横向 16:9);场景图要无人物、无天气描述。
  • 参考主体生视频可以省掉分镜图环节,直接把角色、场景、道具图作为参考,写提示词生成单镜头视频;提示词中要准确 @ 对应的参考图。
  • 图片微调功能:局部重绘、提升画质、多视角、灯光调整、多宫格裁剪、裁剪;视频微调功能:超分、选帧、去字幕、剪辑。
  • HappyHorse 1.0 支持文生视频、图生视频、参考主体生视频和视频编辑(环境替换、风格转换、道具妆造替换、视听调整),并具备多级动作连贯和一镜到底的叙事能力。
  • 提示词要精简、直白,避免文艺描述和废话;特定概念可用中英混合;台词避免特殊字符,读不出的字用同音字代替;使用模型前先看官方指南。

直播回放200 分钟

播放器来自飞书妙记 · 在新窗口打开