跳到正文

从奶牛猫到白猫与橘猫:海辛与阿文拆解《卢浮宫小猫》10w+ 爆款的全流程

讲师 海辛 阿文 · 20:00 直播

2026 年 1 月 10 日,数字艺术家海辛与搭档阿文在 WaytoAGI 社区直播中,完整拆解了他们为浦东美术馆卢浮宫大展制作的官方宣传片《卢浮宫小猫》的创作全流程。这场分享从选角、定调、音乐、分镜到美术执行与动画工具,逐层还原了一条 AI 视频从创意到成片的真实路径。无论你是刚接触 AI 视频的新手,还是正在摸索完整工作流的创作者,都能从中带走可直接复用的工具组合与创作方法。

选角:从奶牛猫到双主角的拆分

海辛与阿文在 2025 年制作了一系列以小猫为主角的影片,包括《故宫猫上班记》《文明小猫游浦东》《咕咕猫猫上班记》等,这些作品在全网获得良好数据,部分入选上海互联网优质作品,还曾在大阪世博会、TED 2025 加拿大温哥华主会场展映。年底,他们受浦东美术馆邀请,为卢浮宫大展制作官方宣传片,主角依然是猫。

最初的选角并非最终呈现的白猫与橘猫。阿文回忆,考虑到浦东美术馆的主色调是黑白色,他们最初选定了一只奶牛猫作为主角,创意是奶牛猫从一幅伊朗布面油画中被晃下来,在卢浮宫游荡穿梭,最后决定跟随展品来到上海。但这一方案最终落选,原因有二:一是内容与宣传排期冲突——宣传期需要两部片子撑满,而原方案的第二部分大半篇幅是公路追逐戏,虽然紧张刺激,但与展览调性不符;二是奶牛猫的花纹在 AI 生成中难以保持一致,容易被观众察觉破绽。

于是他们突发奇想:把奶牛猫拆分成一只白猫和一只黑猫,这样就有了两个短片。最终,法国卢浮宫的故事线由白猫承担,上海浦东美术馆的故事线则由橘猫承担。上半支围绕展品孔雀纹盘,下半支围绕赛诗会饰板,两条影片在浦东美术馆账号及全网大 V 账号广泛传播,还登上了外滩陆家嘴沿海岸及浦东美术馆静厅播放。

定调与音乐:先有情绪,再有画面

在动手制作前,海辛和阿文先为影片定调——确定视觉风格、音乐和整体感觉。海辛说,拿到这个案子时,它有很多关键词需要处理:浦东美术馆、卢浮宫展品、猫主角、上海、巴黎、伊斯兰艺术展、时间地点。他们需要找到最好的切入点。

灵感来自浦东美术馆建筑里的静厅。海辛喜欢静厅实景与影子的概念,而浦东美术馆与卢浮宫、上海与巴黎、两只小猫之间,都存在镜像对应关系。最初她设计了一版上海浦东与卢浮宫镜像关系的方案,后来考虑做分屏——一边上海叙事、一边法国叙事。阿文对图片重新生成美化后,海辛觉得画面"沉了":"整个画面应该就是这样子的感觉,给人一种非常高雅的、优雅的通透的感觉。"蓝色成为主色调,因为它"优雅、离世界远、神圣"。

音乐方面,海辛强调 TVC 广告的音乐要有弧线,配合画面变化产生情绪起伏。他们用苏诺(Suno)生成全部音乐,海辛称这是"我用过最好的音乐工具",因为"能力非常强,自由度非常大",特别适合做叙事类影片音乐。设计思路是:开篇对应钢琴和弦,故事发展进入主旋律,转折处换成悬疑紧张的旋律,高潮后收尾回到漂亮的钢琴和弦。下半支影片到了上海后,他们把上半支的音乐重新上传给苏诺,将音频影响度开到 50%,加入萨克斯等乐器,营造老上海爵士摇摆感。结尾部分做了剪辑,回到只有钢琴和弦的部分。

分镜设计:三个镜头内讲清故事

分镜是海辛认为最花时间也最头疼的环节。她强调,在流媒体时代,开头不吸引人观众就会划走,所以开篇必须有信息量。她的个人审美是"在开篇第一个镜头就能解释清楚整篇是关于什么内容的镜头"——比如《故宫猫上班记》的开头是一只猫,瞳孔里是故宫。

卢浮宫小猫的两支影片,开篇设计是在三个镜头内讲清故事:第一个镜头展示展览海报,让观众知道这是关于展览的视频;第二个镜头用特写介绍主角——法国影片是小白猫,上海影片是橘猫;第三个镜头切到全景,交代环境是卢浮宫或浦东美术馆。为了让开场更有引导性,两支影片都设计了强开场动画——左边拉开、右边瓷砖碎开,避免观众视线没有焦点。

故事第一段,白猫在卢浮宫穿梭。第一个镜头要交代故事发生在卢浮宫,他们没有选择蒙娜丽莎——因为太大众化显得俗——而是选了萨莫色雷斯的胜利女神。海辛特别强调,他们没有用维基百科上常见的拍雕塑本身的构图,而是用了去年 5 月在卢浮宫拍摄的极端仰角,让雕塑作为环境出现,不抢镜,前景的白猫更大,观众的视觉重点始终在主角身上。

第二个镜头引入伊斯兰艺术纹样。海辛展示了一位艺术家在 ins 上的作品,那种"低调的符号变化"给了他们启发——"非常有奇幻的色彩,但又是那种好像在日常生活中会发生的小奇幻"。测试样片中,小猫滑过出现瓷砖的镜头因为过于奇幻被拿掉,换成了定机位、瓷砖动态不抢戏的版本。

第三个镜头最初设想俯拍视角,尝试了魔法阵式、竖起的瓷砖等多种动画形式,但都觉得不够。最终决定让机位从俯拍变前拍,营造从压抑到开阔的反差。瓷砖做成传送带动画,画面中漂浮着空画框——"一旦有画,观众的视线就会到画上面去,他就不会再关注这只小猫了"。阿文对初版不满意,放大了画面细节,加入核心展品孔雀盘,海辛认为这个处理非常高明,因为这是影片中第一次引入核心主角。获得满意的尾帧后,用首尾帧生成视频,达到控制动画运动的目的。

美术执行:选对模型就是选对乙方

阿文负责将海辛的分镜草稿转化为视频画面。他分享的第一个观点是:接到案子后先补艺术史。他们定位到几个"有魔法效用的关键词"——伊兹尼克风格、伊斯兰艺术、马赛克艺术,在写实场景中加入这些关键词,就能让画面具有异域特色。

关于美术,海辛有两个原则:第一眼好看,第二眼耐看。阿文拆解为:好看就是画面要有电影质感,耐看就是往画面里加大量细节。他举了一个例子:用同一段 Prom 在两个不同模型里跑,观众不用 2 秒就能分辨出哪个更有电影感——答案是 Nano Banana Pro。阿文说:"选对模型,就是选对了一个非常好的乙方。"

Nano Banana Pro 的强大语义能力在很多场景中替代了复杂的 PS 操作。比如交片后甲方反馈展品摆放不规范——小猫和盘子窝在一起显得没有好好保护展品——阿文把需求交给模型,"给他打包一下,让他看不出来就可以了"。另一个案例是"小猫上台阶见到孔雀"的画面,抽到很好的画面但内部否了,因为"你的视线一直被小猫的屁眼给吸引住了",调整方式是在第一帧让猫的尾巴垂下来,再让它走上去。

更极端的案例是改猫的颜色。法国卢浮宫片子最初定的主角是黑猫,所有动效都做好了,交片时得到反馈"猫的颜色可不可以调整一下"。阿文说:"比这个需求更荒诞的是它 AI 真的可以改。"他们用上一代 Nano Banana 在 Wix 平台上把黑猫逐镜头改成白猫,只花了一天到一天半。Nano Banana Pro 发布后,批量修改更高效——把所有黑猫竞争上传到海螺,说一声"帮我把这些图片里面的黑猫逐张替换成白猫",模型不仅改好了,还顺带做了 4K 放大。

阿文还分享了几个实用技巧:写 Prom 不需要小作文,要利用模型的多模态理解能力——比如上传布展现场图让 Gemini 生成展品正视图,生成结果与现场几乎一模一样;复杂场景要分次迭代,比如"孔雀影子"镜头,从手稿到透视正确的草稿图,再到铺砖、调整猫的角度、贴展品纹理、换花色,每一步单独处理;实景合成时先裁剪想要的画幅,避免 AI 把不需要的元素吃进去;重复利用特定主体时,先把它提取到纯色背景再换背景,避免 AI 忘掉元素或记错颜色。

动画工具:p 视频时代的工作流

阿文介绍,他和海辛工作流中用的最多的工具是 Google 家的 flow,底模是 Veo 3.1,辅助工具包括可灵海螺、即梦万象、Ruma,Sora 有时用来跑预演。他强调:"我们早就身处一个可以 p 视频的时代了。"

flow 的编辑界面可以往生成视频里加元素、删元素,但不能编辑单个元素。它还能改机位和镜头运动速度。flow 最实用的功能是可以用涂鸦交流——在首帧用涂鸦笔画运动方向并标注文字,然后写一句 Prom:"按照我标注中的说明操作,然后删除我的标注。"橘猫追蝴蝶迈过镜头的画面就是这样实现的。

Ruma 的 Ray 3 有 modify 功能,上传草稿动态预演就能做出不错的效果,画面非常高清。万 2.6 的动物角色功能让阿文惊艳——上传一段画质很差的尼卡视频建角色,生成结果的清晰度和还原度极高,连 AI tag 都还原了。他感慨:"如果早点出现这个工具,那我们那两个片子可能又能到另外一个高度了。"

做微动效时,阿文建议选上一代模型——"上一代的模型它动态就非常差,但是用来做各种微动态的场景刚刚好"。比如落版画面,用 flow 生成时背景元素经常出错,换成即梦 3.0 或即梦 3.0 Pro,告诉它"只要背景的东西动起来",效果就刚刚好。

现场问答

问:视频制作大概花了多久?

答:真正的执行每条片子约两周,但前期设计会不断推翻重来,一条片子总共需要两到四周。

问:做微动效用的是哪个模型?

答:即梦 3.0 或即梦 3.0 Pro。

问:有用到 AE 这类传统动画软件吗?

答:没有,这次确实没有用。

问:AI 生成视频现在有什么做不到的?

答:海辛分享了一个未成功的镜头——橘猫在人群中跳舞,门童拉开和平饭店的门露出老上海场景,然后整个场景像《怪奇物语》那样颠倒过来变成现代上海。这个镜头至少做了两三天,最后没有成功,可能需要等模型升级。

问:如何提升审美创意和技术?

答:海辛认为审美没有好坏之分,"要找到自己喜欢的风格,从内往外创作,做自己喜欢的东西才能做好"。阿文补充,提升分镜能力可以多看优秀影片,带着创作者的角度重看经典,分析分镜、猜下一幕。他还推荐看艺术纪录片,比如陈丹青的《局部》。

问:如何保持猫的一致性?

答:海辛说猫不需要刻意控制一致性——"人类认人的脸非常厉害,但认动物的脸真的不怎么样",主要是花纹。所以不选奶牛猫,因为花纹每次不一样容易被发现,但神态的细微变化观众察觉不到。

问:如何控制动效的随机性?

答:要看镜头类型。图生视频可以在第一帧做注解,告诉模型什么东西往什么地方动;视频转绘视频需要给出明确的运动方向和方式。

问:不用 Midjourney 了吗?

答:阿文说 MJ 的电影感在所有模型中最强,但"实在太不听话了",无法用自然语言做精准控制,细节都要自己重新改。他最喜欢的是 flow,文生视频出来的很多场景都不错。

问:PS 的协调光影功能和 Nano Banana Pro 的自然语言能做到类似效果吗?

答:可以,但没有必要。PS 里拖动元素、点一下协调按钮,交互更直接;香蕉 Pro 是语言交互,没法告诉它"把这个盘子放在图片的绝对坐标轴的什么位置"。

要点回顾

  • 选角从奶牛猫拆分为白猫与橘猫,分别对应法国卢浮宫与上海浦东美术馆的故事线,同时规避了奶牛猫花纹不一致的问题。
  • 定调从浦东美术馆静厅的镜像概念出发,确定轻盈、欢快、干净、透亮的视觉风格,蓝色为主色调。
  • 音乐用苏诺生成,设计情绪弧线:开篇钢琴和弦、发展主旋律、转折悬疑、高潮、收尾;下半支加入萨克斯营造老上海爵士感。
  • 分镜开篇要在三个镜头内讲清故事:海报、主角特写、大环境;用胜利女神而非蒙娜丽莎交代卢浮宫场景。
  • 美术执行先补艺术史,用伊兹尼克风格、伊斯兰艺术、马赛克艺术等关键词让画面具有异域特色。
  • 选对模型就是选对乙方:Nano Banana Pro 能改猫的颜色、调整展品摆放、修复画质,替代大量 PS 操作。
  • 写 Prom 不需要小作文,利用模型的多模态理解能力;复杂场景分次迭代,实景合成先裁剪画幅。
  • 动画工具以 flow 为主,可用涂鸦交流;Ruma Ray 3 的 modify 功能、万 2.6 的动物角色功能值得尝试。
  • 做微动效选上一代模型(如即梦 3.0),避免新模型自行添加背景元素。
  • 模型变强不是偷懒的借口,而是做得更好的理由——"只要在行动,就是在向前走"。

直播回放121 分钟

播放器来自飞书妙记 · 在新窗口打开