2500 万曝光的 AI 视频是怎么做出来的?怪奇物语结局重制全复盘
2026 年 2 月,AI 视频创作者晨然 Ran 用字节跳动旗下的 Seedance 2.0 模型,花一天时间、不到 100 元成本,重制了《怪奇物语》的大结局。这条 2 分半的视频在 X(原 Twitter)平台原帖曝光超 200 万,全网总曝光量约 2500 万,总点赞 50 万,转发近 5 万,还登上了 DEADLINE、福布斯等好莱坞顶级媒体——虽然是以被批评的方式。在 WaytoAGI 社区的「晚八点共学」直播中,晨然完整复盘了这条爆款视频从选题、脚本到生成、剪辑的全过程,并分享了他总结的爆款方法论。本文适合所有想用 AI 视频工具做叙事内容、理解爆款逻辑的创作者阅读。
爆款公式:稀缺性、热门梗、情绪共鸣
在做出这条爆款之前,晨然刚在公司群里发过一篇自己写的「爆款方法论」文章。通过分析推特上各种流量帖子,他得出的核心结论是:内容就是要稀缺。稀缺可以体现在多个维度——价格稀缺(原本需要好莱坞高成本才能制作的 CG 视频)、模式稀缺(受 IP 限制无法让两个公司的角色同框打架)、题材稀缺等等。社交媒体上常见的稀缺还包括电影预告片里剪出的昂贵 CG 打斗场面,以及「在火星上滑雪」这类超越人类日常体验的高动态内容。
在此基础上,爆款内容需要同时满足三个条件:符合稀缺性、踩中某个热门梗、放大情绪共鸣点。晨然这次踩中的是《怪奇物语》结局不满的讨论热潮,共鸣点则是「弥补遗憾」——把观众觉得烂尾的结局改写好,让大家愿意互动和转发。
他也提醒,内容不可能讨好所有人。「即便 99% 是好评,其实也有很多人过来评价说这是一坨屎。」做内容要想清楚受众是谁,精准服务他们,而不是试图让所有人满意。
在正式做出爆款之前,晨然已经用这套方法论做过几次小规模验证:用 Seedance 2.0 做了「在土星上滑雪」的稀缺性内容;在小红书上用「奶龙和皮卡丘」的梗做了 15 秒短片,获得 500 多赞、5 万浏览量。这些实践验证了方法论,但真正的百万级爆款,直到 2 月 12 日的《怪奇物语》重置才出现。
为什么是《怪奇物语》:三个稀缺叠加
晨然分析,这条视频爆火是三个稀缺叠加的结果。
第一,时间节点稀缺。 Seedance 2.0 发布时仅限中国创作者使用,在它正式上线海外之前,海外用户完全没见过这个模型的效果。「以中国创作者的平均水平而言,很多时候是不如好莱坞那些工作室做的视频的」,但正因为有这个时间差,在海外内容还没爆炸之前发布,就吃到了时间红利。
第二,供给稀缺。 大量海外用户从未见过 Seedance 2.0 生成的视频。当供给很低时,一条制作精良的两分多钟叙事视频甩到脸上,带来的震惊感本身就是稀缺。
第三,内容稀缺。 《怪奇物语》是 Netflix 最大的 IP,结局引发巨大争议,甚至「第九季」成了热门话题。做 15 秒的片段和做 2 分半的完整叙事,难度完全不同——后者需要处理叙事结构,会筛掉大量创作者。晨然花了大量时间调研原结局的不足,这种「弥补遗憾」的内容本身也是稀缺的。
不过他强调,创作时并没有冲着爆款去,「而是觉得就是想着做一个有意思的作品去做的」。
脚本是灵魂:80% 的精力花在写剧本上
晨然直言,他花了 80% 的精力在写脚本上。「后面的制作再精良,你的脚本如果没有写得很好,那它也不会爆。」脚本阶段就能预判内容是否有爆款潜力——它决定了在哪一秒能吸引观众注意力、让人想看下去。
选题与调研。 他选择《怪奇物语》有三个原因:自己本身就是多年粉丝、对结局不满、且这是 Netflix 最大 IP。确定选题后,他用 Cursor 里的 Opus 4.6 带联网搜索功能,全网搜索网友对结局的不满之处——主角 Eleven 的结局争议、叙事节奏问题、军方设定糟糕等。这些调研为脚本创作提供了明确方向。
迭代式创作。 晨然并没有一次性写完 2 分半的完整剧本,而是每次只构思 15 秒的剧情。因为 Seedance 单次生成上限是 15 秒,他每生成一段,看到结果后再思考故事往哪里发展。「大家觉得神之一笔的最后 Max 去拯救 Henry 的故事,也是我写到最后才圆回来的。」这种迭代式创作源于他的「P 人」性格,无法按计划写完再制作。
MVP 测试。 在做第二集之前,晨然先花一个晚上做了一个 40 秒的短片作为 MVP——设定很简单:把结局搬回霍金斯小镇,让所有角色参与战场。发到小红书获上千赞,抖音也有 3000 赞,验证了「确实有人想看」,才开始做完整版。
钩子、反转与文戏打戏设计
前 5 秒的钩子。 视频是线性的,观众 2 秒内就能决定是否继续看。「如果你前两秒和前五秒都留不住人,那后面全都是废片。」晨然视频的前 5 秒信息量极高:三个主角打 Vecna 的大战画面、故事背景(霍金斯小镇)、Will 的高光时刻和一句帅气的台词。X 平台数据显示,前 7 秒划走率约 70% 多,但因为信息密度够高,留下来的观众会被牢牢抓住。
每 6-12 秒一个反转。 晨然的设计原则是「每一秒都必须要留住人」,画面要不断推陈出新。他设定了 6 到 12 秒必须有情感变化或反转的节奏——这在影视行业叫「叙事节拍」,短视频的节拍比电影短得多。整个视频设计了 8 次反转:前 5 秒就与原版结局不同;Vecna 打败 Will;Eight 的幻觉看似生效却被抓;联合战斗失败;场外夺心魔加入;最后 Max 成为主角,拯救过去的 Henry,交代夺心魔悬念。每个反转节拍约 15 秒。
三层递进的打戏。 打戏设计遵循「层层升级」原则:第一层是 Will 对抗 Vecna(粉丝等了五季想看的觉醒);第二层是 Eleven 和 Eight 姐妹联手打到天上,开始用藤蔓等武器而非单纯意念控制;第三层是怪物打怪物,超出所有人预期。这三层打戏并非为场面而场面,而是基于剧情本身的张力——Will 曾被 Vecna 控制、三人同出实验室、Vecna 与夺心魔有控制关系,所以打起来既爽又合理。
简短有力的文戏。 短视频台词必须精短,晨然给 AI 的限制是「每个角色必须有高光,台词只能一句话」,设计原则是简短有力、体现人物高光、与其他角色有互动张力。几个经典案例:
- 开场台词「You put this thing inside me, now it's mine」——把创伤变成武器,一句话反转前五季的憋屈感。
- Eleven 的「Only you alone」——三个词直击 Vecna 的孤独,推动剧情。
- Eight 的「Sounds just like papa」——嘲讽 Vecna 变成了自己最讨厌的人,五个词让 Vecna 愤怒。
- Max 的「Gotcha」——两层含义:抓住了石头(控制夺心魔),也拯救了小 Henry。
Seedance 实战:像导演一样工作
晨然强调,Seedance 的提示词「根本就不是让你去写一个非常漂亮的 prompt,而在于你怎么去写脚本、写你要的故事」。它的指令遵循能力极强,「你说什么它就有什么」——写了闪电就一定有闪电,没写就没有。整个生成过程「不像是在抽卡,我感觉我是个导演,我是在说演员你要这么演」。
工具链。 Cursor 写脚本和管理参考图;即梦(Jimeng)里用 Seedance 生成视频;剪映剪辑;Topaz 放大视频清晰度;ElevenLabs 生成转场音效;Medeo(晨然自己负责的产品)生成场景参考图和 PPT。
参考图的使用。 给所有角色设定参考图是为了固定年龄、穿着和战损形象——否则角色年龄会从 11 岁到成年不断变化,甚至出现「Lucas 变成小孩」的诡异情况。人物参考图直接从原剧截图;场景则在 Medeo 中生成后保存,每次上传并描述场景里发生的事。对于没有数据集的怪物,用 Medeo 里的 Nano Banana 重新设计。
生成与混剪。 每 10-15 秒作为一个场景生成,15 秒正好是情绪反转的节拍。同一个 prompt 生成 4-6 次再混剪——因为指令遵循能力强,每次生成的素材高度相似,非常利于剪辑。素材可用率约 60%(打戏部分要求高),多生成几次就能从不同素材中提取可用片段拼接。一个进阶技巧:截取上一场景的尾帧作为下一场景的参考图,可以实现场景衔接——「它竟然可以完美地复原」。
创作心得:直觉、动物时刻与行动力
相信直觉。 晨然坦言,选《怪奇物语》主题、采用 15 秒迭代的工作流,都是直觉驱动。「我做的过程当中是非常痛苦的,并不是这么去想的,我是做完了之后再跟大家去分析,原来我踩中了这些点。」他建议创作者多看电影和热门视频来培养直觉。
设计「动物时刻」。 这个概念来自编剧书《故事》(材质、结构、风格和荧幕剧作的原理)。核心是让观众自己从多个线索中突然领悟剧情,「让观众觉得自己很聪明」。晨然在视频中刻意设计了很多这样的时刻,比如结局揭示 Max 控制了夺心魔,让观众「鸡皮疙瘩一下子起来了」。这类似于产品中的 Aha Moment。
实践出真知。 「分析这么多和真的实际创作确实是两回事。」好的创作是在过程中把模糊感觉变成清晰作品。认知到位后就去实践,通过写脚本、制作、发布、感受反馈来积累「体感」,体感多了才会知道什么内容可能爆。
立即行动。 晨然分享了一个小故事:做完第一集后,他一度怀疑要不要继续。一位创作者朋友鼓励他:「现在 AI 输出的能差到哪里去?做就完了。」还说:「即便现在 AI 工具变得这么快,那你就跟着它变,就像被鳄鱼咬住一样,你就跟着它一起死亡翻滚的频率一样变就可以了。」这番话让他第二天扑了一整天做第二集,结果爆了。「如果有什么好的想法,那就立马去做,毕竟做了之后你才知道会发生什么。」
现场问答
Cursor 是怎么管理剧本和参考图的? 晨然因为自己是程序员、习惯用 Cursor 才这么用。他把参考图放在同一文件夹按编号整理,写脚本时用「@图片编号」引用,建好的文件夹可以一键复制粘贴。但他强调不一定非用 Cursor,Gemini、GPT 等任何带联网搜索的 AI 都能辅助写脚本。
视频清晰放大怎么做? 用 Topaz(TOPAS),这是创作者常用的视频放大工具。
音色一致性怎么保证? Seedance 模型训练时已经知道「这张脸配什么音色」,给脸就能匹配。如果数据集不够丰富,有三种方法:给音色参考(TTS 文件或自己录的音频)、在文字 prompt 中描述音色、用剪映或 ElevenLabs 做 voice to voice 替换。还可以从某个生成片段中抓情绪到位的台词,配上另一个片段的画面。
背景音乐怎么选和处理? 从剪映搜索、用 ElevenLabs 或 SUNO 生成,或用原剧音乐。选音乐凭感觉,剪辑时按音乐节奏切。文戏部分提高背景音乐强调紧张感,打戏部分降低音量突出打斗声。不喜欢生成片段的背景音乐,可用剪映的人声分离处理。
版权问题怎么处理? 晨然刚好卡在 Seedance 2.0 尚未禁止真人上传的窗口期完成了创作,现在已无法制作第三集(参考图上传被限制)。他建议:「大家拿到模型如果说它没有那么多限制的时候,就赶紧先做。」版权限制反而造成了作品的稀缺性,成了「时代遗珠」。
参考图从哪来? 最初尝试用 Banana 生成,但效果太假,后来直接从原剧截图。没有数据集的怪物用 Medeo 里的 Nano Banana 重新设计。
15 秒场景怎么衔接? 按剧本故事发展衔接。场景切换时直接描述新场景即可;需要保持场景相似性时,截取上一场景尾帧作为下一场景参考图。
还需要做 25 分镜图吗? 没必要。Seedance 的叙事能力比 Nano Banana 强,直接给参考图讲故事就行,不需要先用分镜图把叙事讲清楚。
音效怎么生成? 用 ElevenLabs 生成转场音效,比如「螺旋上升再下降」用于能量蓄力和释放,适合放在黑场前,避免 BGM 突然消失的感觉。15 秒生成后剪辑拼接,Medeo 可以一次性生成。
积分消耗多少? 制作第二集在即梦消耗约 3500 积分。每个 15 秒场景生成 6-10 次,多生成是为了提高素材利用率,不算浪费。
镜头剪辑有什么学习资源? 推荐 YouTube 博主 StudioBinder 的 shot list 播放列表,系统讲解每个镜头规格、近景远景特写的用途、焦段作用等镜头语言基础知识。
要点回顾
- 爆款内容三要素:稀缺性(价格、模式、题材、时间节点)、踩中热门梗、放大情绪共鸣点。
- 脚本是核心,花 80% 精力写脚本;用带联网搜索的 AI 调研观众痛点,确定选题方向。
- 视频是线性的,前 5 秒钩子决定生死;每 6-12 秒设置情感变化或反转,整个视频设计 8 次反转。
- 打戏层层升级(地上→天上→怪物打怪物),文戏台词简短有力、必须有高光、有互动张力。
- Seedance 指令遵循能力强,提示词关键是写清故事意图,而非堆砌华丽 prompt。
- 用参考图固定角色年龄、穿着和战损形象;截取上一场景尾帧作为下一场景参考图实现衔接。
- 同一 prompt 生成 4-6 次再混剪,提高素材利用率;可用率约 60%,多生成几次补足。
- 相信直觉,多看片积累创作体感;设计「动物时刻」让观众自己领悟剧情。
- 有好想法立马去做——「做了之后你才知道会发生什么」。
直播回放约 88 分钟
播放器来自飞书妙记 · 在新窗口打开