阿真:打斗提示词总写不明白?分享我的动作导演 Skill。
混用 Seedance 2.5、2.0、2.0 Fast 与 MiniMax H3 测试打斗视频;正文给出多段完整可复制的动作导演提示词,含镜头、动作与声音细节。
领域
215 条 · 2025 年 4 月 22 日 至 2026 年 9 月 2 日
这个领域还有 共学 33 篇 · 学习包 1 个
有一条自己从剧本做到成片的短片,每个环节都知道卡在哪、找谁解决。
想做 AI 短剧或短片,但不知道第一步该干什么的人 · 5 步
2026 年 8 月 3 日,WaytoAGI 社区「晚八点共学」邀请小歪、冷逸、路西、丁一、神思远、大福六位创作者,围绕扣子平台接入 Seedance 2.5 的视频生成能力,做了一场完整的实操分享。内容覆盖平台基础规则、两种创作路径、提示词撰写规范、进阶功能(视频延长、拉片复刻、资产库),以及电商、短剧、MV、广告…
2026 年 5 月 29 日,WaytoAGI 视频板块主理人小歪在阿里云 AI 创享日专场中,用万镜一刻平台的画布功能完整演示了 AI 短剧的制作流程。这场分享适合想用 AI 做短剧、但还没跑通全流程的创作者,也适合已经在做但总被角色不一致、背景污染、抽卡率高等问题困扰的人。小歪从剧本拆解、角色与场景准备,到单镜头…
讲师 小歪
2026 年 5 月 13 日,WaytoAGI「晚八点共学」邀请 AIGC 数字艺术设计高级工程师、AI 动画师、超创计划联合发起人大鹏,围绕阿里最新登顶榜单的视频生成模型快乐马 HappyHorse 展开了一场两个小时的直播共学。大鹏结合自己用该模型制作广告、短剧、文旅片的实战经验,拆解了模型的长处与短板、导演式提…
讲师 大鹏
2026 年 5 月 4 日晚,WaytoAGI 社区举办了一场特别的分享会:参与社区三周年「离谱音乐会」共创的五个小组代表齐聚线上,逐一拆解各自节目的创作过程。从电音秀的美术设计、AI 音乐生成,到极限 10 天的视频制作、现场乐队组建,再到环形屏分镜与角色调度,这场分享覆盖了 AI 共创项目的完整链路。适合所有对 …
2026 年 5 月 3 日晚,WaytoAGI 三周年大片主创团队做客社区直播,由超级创作者「上分吧 PT」带队,联合文案策划梦梦、后期视效导演 Renee X(常小常)与主持人小马,完整拆解了这支刷屏级作品的制作全流程。这场分享适合所有想用 AI 视频接单、打比赛,或正在摸索 AI 工作流的创作者——它不讲软件按钮…
讲师 上分吧PT、梦梦、Renee X、小马
如果你有一个动画梦,但既不会画分镜、也不懂剧本结构、更没预算组建团队,OiiOii 想让你只靠对话就把脑海里的想法变成一部能发到抖音的成片。在 WaytoAGI 的「晚八点共学」直播中,OiiOii 产品经理杨盼祎和糍粑完整拆解了这款「全球首个动画创作 agent」的产品逻辑与实操流程,从角色设计、自由画布到九宫格分镜…
讲师 杨盼祎、糍粑
2026 年 4 月 9 日,扣子联合 WaytoAGI 举办了一场以「玩转扣子 2.5」为主题的视频专场直播。主持人马乐与三位嘉宾——设计博主野川、资深设计师 AK007、AI 导演周易——围绕扣子 2.5 的全新视频 Agent 能力,分享了各自的人设设定、使用体验与完整作品案例。无论你是刚接触 AI 视频的新手,…
讲师 周易、野川设计、AK007设计师
2026 年 3 月 30 日晚,WaytoAGI 社区邀请 AIGC 数字艺术家、影视导演南墙 Rylee 与 LibTV 产品负责人梦楠,围绕「AI 影像狂飙季」百万奖金挑战赛展开了一场近两个半小时的深度分享。南墙 Rylee 现场拆解了其用 LibTV 全流程制作的漫剧短片,从角色设计、场景生成到批量出片完整演示…
讲师 南墙Rylee、梦楠
2026 年 2 月,AI 视频创作者晨然 Ran 用字节跳动旗下的 Seedance 2.0 模型,花一天时间、不到 100 元成本,重制了《怪奇物语》的大结局。这条 2 分半的视频在 X(原 Twitter)平台原帖曝光超 200 万,全网总曝光量约 2500 万,总点赞 50 万,转发近 5 万,还登上了 DEA…
讲师 晨然 Ran
2026 年 1 月 14 日,PixVerse 正式发布全球首个实时生成世界模型 R1。在 WaytoAGI 社区「晚八点共学」直播中,PixVerse 全球运营负责人张雄弈、R1 核心成员兼科学家曹翔、AI 导演齐马橙现场演示了这款产品的实时交互能力,并拆解了其背后的技术理念与未来规划。本文适合 AI 视频创作者、…
讲师 张雄弈Davy、齐马橙、神秘嘉宾
2026 年 1 月 10 日,数字艺术家海辛与搭档阿文在 WaytoAGI 社区直播中,完整拆解了他们为浦东美术馆卢浮宫大展制作的官方宣传片《卢浮宫小猫》的创作全流程。这场分享从选角、定调、音乐、分镜到美术执行与动画工具,逐层还原了一条 AI 视频从创意到成片的真实路径。无论你是刚接触 AI 视频的新手,还是正在摸索…
讲师 海辛 阿文
2026 年 1 月 5 日晚,WaytoAGI 第三期 AI 短剧训练营正式结营。这场结营分享会上,小鱿鱼公布了 18 位优秀学员名单,随后十余位优秀学员代表依次分享了从剧本拆解、分镜生成到视频剪辑、音频设计的完整创作链路与踩坑经验。无论你是刚接触 AI 视频的新手,还是想提升短剧制作效率的创作者,这些来自一线实战的…
讲师 高雁、小鱿鱼
2025 年 12 月 30 日,WaytoAGI 社区邀请到 AIGC 创作者、曾与贾樟柯合作导演共创计划的 JadeWu,围绕百度与乐华娱乐的「AI 星企划」数字角色选秀大赛,分享了一套完整的数字人制作方法论。JadeWu 既是可灵、海螺、混元等多个平台的超级创作者,也有为华硕、AMD、王力宏等品牌和艺人制作数字人的…
讲师 JadeWu
12 月 29 日晚,AIGC 数字艺术设计高级工程师、AI 动画师大鹏在 WaytoAGI 社区「AI 短剧训练营」加餐课上,围绕 Sora 2 的模型特性、数据集构成、视频生成方式与提示词技巧展开分享,并逐一点评了学员提交的第八课作业。无论你是正在用 AI 工具做短剧的创作者,还是想了解 Sora 2 实际能力上限…
讲师 大鹏
2025 年 12 月 28 日,AIGC 广告与短剧导演周鹏在 WaytoAGI 社区直播中,用一套完整的国漫风格小故事,演示了如何用 Lovart 和 Typenow 两个整合平台,从人物资产、分镜设计、批量出图到动态分层与视频合成,一站式完成一条短片的制作。这场实操课适合正在学习 AI 短剧、想摆脱多平台来回切换…
讲师 周鹏
12 月 27 日晚,广告片 / 纪录片导演、AIGC 艺术家丁一在 WaytoAGI 社区「晚八点共学」直播中,分享了他将 AI 工具嵌入影视工业化流程的实战经验。这场分享面向已有一定 AI 视频基础、想往影视级制作方向进阶的创作者,内容涵盖 Sora 2 动态分镜工作流、多工具协同保证人物与场景一致性、AI 复刻电…
讲师 丁一
2025 年 12 月 23 日晚,WaytoAGI「AI 短剧训练营」第 7 课由导演、剪辑师沐己主讲,主题为「AI 剪辑高级技巧」。这场分享面向正在学习 AI 漫剧、短剧剪辑的创作者,核心观点是:剪辑技术不是核心,内容判断能力才是。沐己从剪辑思维、节奏把控、镜头衔接规则讲到学员作品点评,并预告了后续的 Sora 工…
讲师 沐己
2025 年 12 月 22 日,WaytoAGI「晚八点共学」邀请 Medeo 产品负责人晨然、AI 艺术家歸藏和英语教育专家 Mona,围绕 AI 视频创作工具 Medeo 展开了一场实操分享。三位嘉宾分别从产品设计、提示词工程和真实教学场景出发,演示了如何通过自然语言对话完成从灵感、脚本、分镜到成片的完整视频创作…
讲师 晨然、歸藏、Mona
在 AI 短剧制作中,音频往往被当作后期环节,但资深导演、剪辑师沐己(老王)在 WayToAGI 社区「AI 短剧训练营」第 6 课中提出了一个反直觉的观点:音频工作应该前置到生图阶段之前。这场分享围绕 AI 短剧的音频设计展开,系统拆解了漫剧与真人剧的音频差异、配音工具的选择与使用、BGM 的生成逻辑以及音效的获取途径…
讲师 沐己
这堂课由夜游榊老师主讲,围绕 AI 短剧制作中「图片融合与关键分镜」这一核心环节展开。课程从第三课作业点评切入,完整演示了角色三视图的生成方法、多角色一致性控制、场景图的生成与调整,以及如何将角色融入关键分镜的全流程。适合正在学习 AI 短剧制作、希望提升出图精准度和效率的创作者阅读。
讲师 大鹏
2025 年 12 月 13 日,WaytoAGI 社区「晚八点共学」邀请到 Mulan.pro 团队——CEO 刘如山、技术负责人一乐、美国市场负责人 Joyce,以及专家级用户叶彦辛,围绕 AI 视频创作工具 Mulan.pro 展开了一场产品演示与创业历程分享。这场直播既是一次上手教程,也是一次关于「普通人能否在…
2025 年 12 月 12 日,WaytoAGI 社区「AI 短剧训练营」第三期第三课开讲,由大鹏老师主讲「图片生成与项目资产」。这场课面向已经完成剧本拆解、准备进入实际制作的学员,核心解决两个问题:一是 AI 短剧行业里各个岗位到底谁值钱、为什么值钱;二是如何用即梦等工具,把剧本里的人物、场景、道具变成可复用的项目…
讲师 大鹏
2025 年 12 月 10 日晚,WaytoAGI 社区 AI 短剧训练营第二课开讲,讲师夜游榊围绕「短剧剧本结构 × AI 分镜实战」展开分享。课程从点评学员拉片作业切入,系统讲解了分镜脚本的定义、核心构成元素、常用景别与运镜,并用手工拆解和 AI 拆解两种方式,完整演示了如何把一个商业剧本拆成可执行的分镜表。适合…
讲师 夜游榊
2025 年 12 月 8 日晚,WaytoAGI 社区第三期 AI 短剧训练营正式开营。开营第一课由 AIGC 艺术家、编剧与剪辑师夜游榊主讲,主题为「短剧行业现状与爆款观片」。课程面向对 AI 短剧创作感兴趣的零基础学员与希望入行的从业者,系统拆解了漫剧行业的市场体量、变现模式、制作流程与团队配置,并布置了第一份拉…
讲师 夜游榊、高雁、小鱿鱼
2025 年 11 月 4 日,WaytoAGI 社区邀请剪映 AI 模板作者小歪和红泥小火炉,在「晚八点共学」直播中完整拆解了「剪映 AI 模板创想季」赛事。两位讲师从报名审核、赛道选择、提示词撰写到模板发布与测试,覆盖了参赛全流程,并现场演示了多个模板的制作方法。无论你是刚接触 AI 模板的新手,还是想提升模板质量…
讲师 小歪、红泥小火炉
2025 年 9 月 25 日晚,WaytoAGI 社区邀请冰鱼仔、素语、晓彦三位创作者,分享百度智能创作平台的使用经验与 AI 导演大赛的参赛心得。这场分享适合刚接触 AI 视频、想快速上手一键成片的新手,也适合正在寻找爆款方法论、准备参加 AI 创作比赛的进阶玩家。三位嘉宾从平台功能、创作流程、爆款判断到提示词优化…
9 月 22 日晚,WaytoAGI 社区邀请百度智能创作平台的运营、研发与设计团队,围绕「AI 导演大赛」展开了一场近两小时的深度分享。百度运营同学范范、研发工程师小艺、设计师李楠(晓娜)与主持人兼参赛者大鹏,分别从平台功能、技术原理、爆款制作技巧和赛事规则四个维度,完整拆解了如何用百度智能创作平台从零产出一条高质量…
在 WaytoAGI 社区「晚八点共学」中,创作者金属文以自己使用万相 2.2(One 2.2)制作的短片为例,完整拆解了从创作动机、音乐制作、脚本分镜、生图、视频生成、配音音效到剪辑发布的 AI 视频全流程。这场分享适合正在尝试 AI 视频创作、希望提升短片质量与制作效率的创作者阅读——尤其是那些对角色一致性、提示词…
讲师 金属文
如果你是一个内容创作者,是否经历过这样的场景:写脚本用一个工具,生图换一个平台,配音再找另一个服务,最后剪辑还要回到剪辑软件——灵感在工具切换中被消耗殆尽。OpenCreator 的产品负责人小曼在 WaytoAGI 社区路演中分享了这款产品的解法:把创作本身还原为一个工作流,让创作者在一个画布上完成从灵感到成片的全过…
讲师 小曼
2025 年 8 月 18 日,AI 视频创作者娜乌斯嘉(娜娜酱)在 WaytoAGI 社区「晚八点共学」直播中,围绕「我 AI 北京——第二届北京城市形象 AI 创作征集」比赛,分享了一套从微缩景观视频制作到比赛投稿的完整方法论。她结合自己制作全国省份地标微缩视频的实战经验,逐一拆解了 Midjourney、即梦、豆…
讲师 娜乌斯嘉
2025 年 8 月,AI 动画《瑞克和莫蒂勇闯刻板印象宇宙》在 B 站刷屏。作者「梦游牛油果」(刘士超)在 WaytoAGI 社区直播中,完整拆解了这部作品的幕后制作流程。本文适合想用 AI 做动画、但不知道从何下手的创作者阅读——刘士超反复强调的核心观点是:AI 只是提速工具,剧本和分镜才是作品的灵魂。
讲师 梦游牛油果
2025 年 8 月 11 日,AI 动画创作者二金(刘士超)在 WaytoAGI 社区直播中,以自己制作的《瑞克和莫蒂勇闯刻板印象宇宙》为例,完整拆解了个人如何借助 AI 工具完成一部动画短片的思路与流程。这场分享适合正在尝试 AI 视频创作、想了解从创意到成片全流程的创作者阅读——二金的核心观点是:AI 降低了制作…
讲师 二金
2025 年 8 月 5 日晚,WaytoAGI 社区「晚八点共学」直播聚焦 AI 视频创作,邀请视频版版主小歪与开源开发者朝戈(长毛猪)分别带来通义万相 2.2 线上版的功能全景实操,以及 ComfyUI 本地部署与 Wan2.2 模型首尾帧工作流的硬核教学。无论你是刚接触 AI 视频的新手,还是想将开源模型部署到本…
讲师 小歪、猪哥
混用 Seedance 2.5、2.0、2.0 Fast 与 MiniMax H3 测试打斗视频;正文给出多段完整可复制的动作导演提示词,含镜头、动作与声音细节。
H3 Max 生成 5 秒 768p 音视频不到 3 秒,吞吐量约为 H3 的 35 倍;H3 开源三周下载量超 2400 万次,产生超 300 个衍生模型。
以“Yuri 宇宙”为主题,使用虚拟偶像 Yuri 形象创作 10-20 秒 16:9 视频;9 月 6 日 21:00 截止,金奖 399 元,入围作品将在 Yuri 外滩大会线下演唱会大屏展映。
8 月 30 日全国 50+ 城市联动举办 AI 短剧创作大赛,到场送 AniShort 500 积分;Wan3.0 全系列模型限时 5 折,活动日期 8.24-8.31。
8 月 30 日全国 50+ 城市联动举办 AI 短剧创作大赛,到场送 AniShort 500 积分;Wan3.0 全系列模型限时 5 折,活动日期 8.24-8.31。
本期主题为 AI×新人类图鉴,视频规格 3:4、15-30 秒、1080P 以上;金奖 2000 元,另有 15000 元全员创作奖池,9 月 11 日 21:00 截止。
8 月 30 日全国 50+ 城市联动举办 AI 短剧创作大赛,到场送 AniShort 500 积分;Wan3.0 全系列模型限时 5 折,活动日期 8.24-8.31。
55 个仓库中 28 个是装进 coding agent 的 skill,平台型过半做短剧;skill 化是最活跃增量,产线编排层竞争大于模型本身。
8 月 30 日全国 50+ 城市联动举办 AI 短剧创作大赛,到场送 AniShort 500 积分;Wan3.0 全系列模型限时 5 折,活动日期 8.24-8.31。
Seedance 2.0 fast 在情绪递进与动作连贯上优于 MiniMax H3 和 Wan 3.0;7 组案例均附完整可复制提示词。
8 月 30 日全国 50+ 城市联动举办 AI 短剧创作大赛,到场送 AniShort 500 积分;Wan3.0 全系列模型限时 5 折,活动日期 8.24-8.31。
8 月 30 日全国 50+ 城市联动举办 AI 短剧创作大赛,到场送 AniShort 500 积分;Wan3.0 全系列模型限时 5 折,活动日期 8.24-8.31。
围绕原生多模态视频模型 H3 构建,支持语义级创作与编辑;提供 3D 导演台等能力,覆盖从分镜到成片的完整商业内容生产流程。
updream 预演台可上传参考图自动生成带深度的 3D 白模,支持人物、机位、轨迹与关键帧调度;粗粒度白模用于控空间与运镜,细粒度白模可把视频模型当渲染器。
开源部分约 600 亿参数,官方推荐 SGLang、vLLM、diffusers、ComfyUI 推理;H3-Context-IR 与 Regenerate-2K 暂未开源,后者官方称即将放出。
原生最长 30 秒、支持多模态输入与角色一致性;众测收集近 100 份作品,覆盖短剧、广告、MV 等 10 条展示。
H3 开源一周衍生近 300 个模型,ComfyUI 版本下载量近 700 万;社区将最小模型组合内存占用从 123.6GB 降至 42.5GB,并出现长视频续写、图像编辑、音频生成等玩法。
单条最长 30 秒,可直接读取网页链接及 Word、Excel、PPT、PDF、Markdown 文件生成视频;实测覆盖网页科普、Excel 数据汇报、产品演示、多图参考等 5 大类场景。
项目公开了 11 万多条生成记录,每个镜头的提示词和参数都可查看;官方附带了 CINEDANCE HIGGSFIELD SKILL.md 提示词规范。
8GB 显存可跑 FLUX.2 Klein 9B 与 MiniMax H3 INT4,瓶颈在内存;出视频必须用 fl2v 钉死首尾帧,i2v 帧间漂移达 41。
95 分钟长片由 15 人团队以低于 50 万美元预算制作,14 天完成内容生成;全片每帧均为 AI 生成,无需摄像机、演员及实景搭建。
MiniMax H3 基础模型权重已开源,提供海螺 AI、MiniMax Hub、开放平台 API、Hugging Face 与魔搭社区五个入口;作者实测其广告生成能力,给出纯视觉产品广告与感官型饮品广告两套完整提示词。
全模态生成系统,支持最高 2K 分辨率、15 秒带原生立体声的视频;H3-Context-IR 不包含在开源发布中,仅提供 API 与提示词指南。
MiniMax H3 与 Seedance 2.5 同日发布,H3 主打商用多场景、多素材参考与原生音画协同;H3 2K 档最低 0.4 元 / 秒,作者实测 30 多组案例覆盖分屏、UI、产品广告等方向。
单段视频生成从 15 秒提升至 30 秒,支持最长 3 分钟超长视频与多轮延长;单次最多支持 50 个多模态参考素材(30 张图片、10 条视频、10 条音频)。
单次生成最长 20 秒带音频视频,对比偏好率最高 69%;图像与动作预测能力将分阶段开放早期访问。
ChatCut 是集成在 Codex 与 WorkBuddy 中的 AI 视频编辑工具,提供时间线看板支持手动微调;文末附完整剪辑视频的开源 Skill,安装后可直接调用。
用 Codex 串联 Imagegen、F5-TTS、Remotion 等工具做本地视频流水线;分四层拆解画面,按角色类型设置不同动画参数。
把「写不完美」拆成八个维度,每个维度都给出可直接抄的提示词公式;用 GPT Image2 出分镜、Seedance 2.0 跑出球衣带货视频,全程无真人出镜。
Vibe Motion 用代码驱动动画生成,核心框架为 Remotion 与 HyperFrames;作者实测两周踩坑 10 个,沉淀出 DESIGN.md + CLAUDE.md + SKILL 的单 Agent 架构。
15 秒 4K 视频烧掉 1200 积分,折合一条近 100 元;5 组对比中 4K 在雨滴、金属、钻石切面等细节上明显优于 720P,但存在越轴、手机一致性漂移等抽卡事故。
Seedance 2.0 支持全能参考,物理规律与长视频一致性提升;《丧尸清道夫》作者用其 10 天、3000 元成本完成制作。
本期主题为「我来组成头部」,要求 16:9、5-15 秒单镜头或一次性生成片段,30FPS 以上;金奖 399 元,截止 6 月 14 日 21:00。
工作流分定人群、找对标、做固定 AI 模特、动作迁移四步;强调人物与服装细节不变、场景变化、9:16 真实手机拍摄感。
《丧尸清道夫》播放量破 4600 万、点赞 222 万,制作成本约 3000 元;作者用约 10 天完成,非科班出身。
给出故事、资产、分镜三套可直接复制的提示词;用 Gemini 3.5 Flash 生成故事与分镜,即梦、LibTV、Flow 生成视频。
HyperFrames 是 HeyGen 开源的 Agent 剪辑工具,需配合 Codex App 使用;提供多套可直接复制的提示词模板,支持对话式迭代修改视频。
可灵视频 3.0 系列新增原生 4K 直出选项,每秒消耗 30 灵感值;即日起至 6 月 30 日会员享 4K 生成限时优惠,铂金及以上 8 折、黄金 9 折。
阿里发布世界模型 HappyOyster,支持一句话或一张图生成可 WASD 漫游的 3D 空间;Direct 导演模式可在生成中持续插入指令实时改剧情,当前处于 Beta 内测阶段。
整理出 6 大类 19 种 AI 视频转场技巧,每种附通用模板与套用示例;转场可通过单条提示词或后期剪辑拼接实现。
系统梳理推、拉、摇、移、环绕、升降、希区柯克变焦等主流运镜,每种附通用模板与套用示例;模板中【】部分可替换为自定义内容。
直播围绕 AI 视频创作技巧展开,Pt 分享了提示词撰写、垫图与光影优化方法;小歪介绍了 LibTV x Seedance 2.0 百万奖金大赛的报名流程与规则。
HappyHorse 1.0 在 Artificial Analysis 盲测中登顶文生视频与图生视频榜首,4 月 10 日阿里官宣其为自家模型;作者收集 60 多条带提示词的对比案例,指出其在指令遵循与流畅度上优于 Seedance 2.0,但部分物理细节仍有瑕疵。
支持文本、图像、视频、音频全模态输入,覆盖生成、编辑、复刻、重塑、驱动、续写、参考全链路;最多支持 5 个视频主体参考,实现外观和音色锁定。
基于贺岁片《老马的 AI 囧途》项目经验,覆盖从选题到宣发的完整链路;团队开会 50 多小时,AI 平台积分消耗快,成本意识需从项目第一天就有。
Seedance 2.0 上线 LibTV,角色一致性与长镜头连贯性显著提升;LibTV 发起百万 AI 影像狂飙季大赛,设 3 赛道 8 项单元奖共 50+ 席位。
以“小龙虾”为主题,要求 16:9、5-15 秒单镜头或自动剪辑段落、30FPS 以上;金奖 399 元,3 月 29 日 21:00 截止提交。
本期主题为“复工”,要求 16:9、5-15 秒单镜头或自动剪辑段落,30FPS 以上;金奖 399 元,截止 3 月 15 日 21:00。
基于 OpenClaw 与 Seedance 2.0 实现文生视频、图生视频与参考视频生视频全流程;代码已开源至 GitHub,需手动配置浏览器 cookie 并调整超时参数。
总结 Seedance 2.0 的 9 种商用玩法,含追热点、商业广告、穿搭变装、直播带货等;提示语已整理成文档,公众号回复 S2 获取。
LuxReal 是群核科技推出的 AI 短剧视频创作工具,提供 Agent 和 Canvas 两种模式;支持上传最多 5 张参考图并输入剧情描述,可生成带对白和分镜的完整短剧视频。
全网总曝光保守估计 2500 万 +,仅 X 平台 92 条相关推文浏览量达 1914 万;视频被全球至少 6 种语言搬运,好莱坞媒体 Deadline 与 Cosmic Book News 做了专题报道。
Seedance 2.0 以统一多模态架构实现从分镜到音画合成的全流程智能化;传统 AI 短剧制作依赖多工具拼接的工业组装流程,前期筹备与中期制作环节繁琐且一致性难保证。
Seedance 2.0 支持四模态输入,一次生成 15 秒带双声道音频的多镜头视频;众测团沉淀出 100+ Prompt 模板和 20+ 行业解决方案。
全网总曝光保守估计 2500 万 +,仅 X 平台 92 条相关推文浏览量达 1914 万;视频被全球至少 6 种语言搬运,好莱坞媒体 Deadline 与 Cosmic Book News 做了专题报道。
Seedance 2.0 支持全模态输入,可参考 9 张图片、3 段视频、3 段音频;API 春节后上线火山引擎,可直接嵌入工作流和 Agent 管线。
Seedance 2.0 支持复杂动态图形与多角色打斗场景,语义遵循度高;可结合实拍素材生成全息 UI,并支持图片参考生成视频。
Seedance 2.0 的全能参考实现跨光线、跨风格的角色资产无缝融合,泛化能力大幅提升;作者认为大众媒体消费市场的进入门槛已几乎归零,首尾帧工作流范式将告别。
众测团 8 天动用 100+ 创作者测了 3,000+ 条视频,提炼出 29 种玩法;玩法按电商投流、品牌广告、短剧叙事、社媒玩法、企业商用五大类组织,每个玩法附实测 Prompt 与避坑指南。
第 67 期视频挑战赛由野神殿等社区共同发起,投稿截止 2 月 12 日 21:00;需从两款汾酒中任选其一创作 5-15 秒 AI 短视频,一等奖 2000 元现金加酒品。
Seedance 2.0 支持图像、视频、音频、文本四种模态输入,混合输入上限 12 个文件;仅提供图片参考时消耗积分比同时提供图片和视频素材少一半。
提示词以四维解构框架组织,含视觉锚点、动态矢量、高熵细节与意境留白;附三组测试样例,每组给出 0-15 秒分段时间轴的全量画面描述。
Seedance 2.0 支持 15 秒视频生成,人物一致性与指令遵循能力突出;作者整理了 7 种玩法并附完整提示词,含短剧、跨界对战、伪纪录片等场景。
运镜提示词分基础术语、情绪修饰、组合运镜三级;给出 Pan、Zoom、Dolly 等核心词及 Smooth、Slow、Fast 等修饰词示例。
Seedance 2.0 支持多模态输入与全能参考,可同时上传图片、视频、音频生成视频;一致性提升,切镜头丝滑,九宫格生成视频支持良好。
支持图像、视频、音频、文本四种模态输入,可上传 9 张图、3 个视频参考或音频驱动生成;生成时长 4-15 秒,自带音效配乐,文件混合输入上限 12 个。
Vidu Q2 参考生 Pro 支持 2 视频 +4 图片同时创作;Vidu Q3 为全球首个支持 16s 声画同出的模型,在 Artificial Analysis 榜单中国第一、全球第二。
视频 3.0 支持智能分镜、图生视频加主体参考、多语种口型配音与 15 秒超长生成;视频 3.0 Omni 新增全能参考与主体 3.0,支持上传角色视频提取特征与原声音色。
Vidu Q3 于 1 月 30 日发布,全球首个支持 16 秒音视频直出;在 Artificial Analysis 榜单中排名中国第一、全球第二。
Ray3.14 支持原生 1080p,速度提升 4 倍、成本降低 3 倍;实测 10 个平台中 Runway 效果较差,修改提示词后流淌动作明显。
Genie 3 支持 20-24 帧每秒、720p 实时渲染,可保持数分钟世界一致性;目前仅对美国用户开放,需订阅 Google AI Ultra,每月 250 美元。
谷歌向美国 18 岁以上 Ultra 用户开放 Genie 3 试用,支持实时生成 24 帧 720P 可交互视频;实测操控延迟低、物理交互真实,可保持角色与环境一致性超一分钟。
以真实 SOP 拆解 AI 漫剧制作流程,强调视听语言与声音组接是分水岭;分镜阶段即规划声音延续,工具混用(即梦、MJ、可灵、海螺)按镜头目标选择。
支持最高 1080P 分辨率,延迟从秒级降至即时响应;基于 Omni 原生多模态基础模型、自回归流式生成机制和瞬时响应引擎三大技术。
海辛与阿文在 WaytoAGI 直播公开卢浮宫 AI 视频幕后 200 页 PPT;工作流覆盖选角、定调、音乐、分镜、美术与动画,主力工具为 Flow 与 Veo3.1,音乐由 Suno v5 生成。
提供视频分镜反推系统 V3 完整提示词,可拆解视频并生成可复用元提示词模板;推荐使用 Qwen Chat 或 Gemini,Qwen Chat 完全免费。
实测 5 款音画同步模型,Sora 2 情感表现最佳但画质偏糊;Seedance 1.5 Pro 对口型与氛围细节最稳。
Flow 免费整合 Nano Banana Pro 与 Veo 3.1,支持无水印下载 1K/2K 图;教程给出改焦点、改天气、图生视频的分步操作。
Medeo 支持聊天、生成、剪辑全流程,可自动完成从文本到视频的创作;提供智能聊天、素材匹配、全流程生成与智能剪辑等功能。
AI 短剧训练营第六课今晚 20:00 直播,主题为 AI 剪辑音效与台词;结营典礼定于 1 月 5 日 20:00,优秀学员作业截止 12 月 31 日。
Wan 2.6 新增视频角色功能,上传 5 秒参考视频即可在生成中调用并保留音色;模型对影视级分镜提示词响应进一步提升,支持 1080P API。
Medeo 内测中,今日邀请码无限畅用;支持聊天式创作、剪辑轨道编辑,覆盖科普、新闻、广告、漫剧等全品类。
AI 短剧训练营第六课今晚 20:00 直播,主题为 AI 剪辑音效与台词;结营典礼定于 1 月 5 日 20:00,优秀学员作业截止 12 月 31 日。
AI 短剧训练营第六课今晚 20:00 直播,主题为 AI 剪辑音效与台词;结营典礼定于 1 月 5 日 20:00,优秀学员作业截止 12 月 31 日。
课程围绕 AI 短剧制作,讲解漫剧、短剧、动态漫区别及即梦、海螺、Nanobanana Pro 等工具用法;作业要求基于四个商业剧本之一生成人物、场景、道具的三视图和全景视图。
AI 短剧训练营第六课今晚 20:00 直播,主题为 AI 剪辑音效与台词;结营典礼定于 1 月 5 日 20:00,优秀学员作业截止 12 月 31 日。
AI 短剧训练营第六课今晚 20:00 直播,主题为 AI 剪辑音效与台词;结营典礼定于 1 月 5 日 20:00,优秀学员作业截止 12 月 31 日。
新增 Audio 与 Multi-shot 两大原生直出参数,可在提示词中直接控制音效、台词、音色、音乐与镜头;实测四个 Case 模拟宣传片制作流程,验证叙事与音画同步能力。
面向少儿 AI 春晚共学,梳理豆包、DeepSeek、即梦、海螺、可灵等 AIGC 视觉创作工具;给出像素风文旅视频、人物多元化展示、VR 博物馆探馆等实操提示词与流程。
TapNow 与欧阳英豪导演用 AI 为汤臣倍健制作南极探险 TVC,全程采用专业实拍流程与 JSON 提示词精细控制;平台已开源全部创作流程,作者随后用其复刻王老吉风格为青岛白啤制作 1 分钟广告片。
Luma Ray3 于 2025 年 9 月 19 日发布,官方称其为全球首个具备推理能力的视频模型,并原生支持 HDR EXR 输出;实测中推理模式能还原喷涂过程但字体准确性不足,草稿模式生成速度最快提升 20 倍。
LTX-2 以原生 4K、唇语同步和 10 秒连续生成入场,与 Veo 3.1、S2 在 9 个商业赛道横向实测;LTX-2 转场更丝滑,Veo 3.1 声音细节最佳。
海螺 AI 2.3 新增舞蹈舞种识别、人物表情与光影效果、动态碰撞细节等能力,每日免费生成 4 次视频;文章附多场景实测提示词,含图生视频与文生视频玩法。
单个视频成本约 0.3 元(30 积分 /15 秒 /720P),生成约需 5 分钟;通过豆包扩写提示词并英文改写后,镜头多样性和视觉效果明显提升。
Veo3.1 新增首尾帧与多图参考功能,可迁移创意玩法;作者在 lovart.ai 薅到一个月免费 Veo3.1 fast 和 Sora2 额度,跑了一百多个视频总结出 10 种玩法。
复盘联想与海螺 AI 创意视频大赛获奖广告片,按“文图视音剪”五步模型拆解制作流程;分镜脚本用 Kimi 生成,人物一致性用 Midjourney 的--cref 指令,产品图用 PS 溶图合成。
团队三人两周内完成作品,获岳阳楼 AIGC 大赛银奖;复盘给出分镜公式、转场手法与首尾帧提示词。
Grok Imagine v0.9 支持语音优先界面、音频同步与图像转视频,10-15 秒生成 6 秒视频;目前免费不限量、导出无水印,人声说话不如 Wan 2.5。
Veo 3.1 新增全功能音频、素材生视频、Frames to Video、延长与插入 / 移除编辑能力;提供 Fast 与 Quality 两种模式,每次最长生成 8 秒 1080P 视频。
多参宗社群主理人 Eason 的个人专栏上线,汇集 vidu、即梦、海螺等平台的教程与拆解;社群现有 40 多个群、约 1 万人,每周有公益直播。
征稿面向城市动物公益宣传短片,时长 10 秒至 3 分钟,10 月 25 日截止;一等奖 5000 元,共设 13 个奖项。
Sora 2 在 GPQA Diamond 推理基准上得 55%,GPT-5 为 72%;系统提示词含「Juice」参数,疑似由 GPT-4o 等 LLM 先重写提示词再生成视频。
Sora 2 发布 24 小时内引爆短剧、广告、动漫、声乐等五大创作方向;OpenAI 通过独立 App 将工程能力打包,实现从玩具到工具的跃迁。
Sora 2 为原生视频与音频生成模型,主打物理模拟与 Cameo 数字分身功能;Sora App 以 Cameo 与 Remix 构建社交裂变玩法,免费用户每天可生成 50 条 10 秒 360P 视频。
Sora 2 定位为世界模拟器,能模拟物理因果与失败;配套独立 App 上线,含反成瘾设计与 Cameo 数字分身功能。
跑 3 天、1000 多个视频测试,选 200+ 效果对比;可灵 2.5 Turbo 与 Veo3 等四家各抽卡 5 次择优。
纸巾变万物视频分两步:先拍纸巾掉落截帧,再图生视频;提供 Higgsfield、可灵、Vidu、剪映四款工具的替换主体提示词。
通义万相 2.5-Preview 支持原生音画同步、10 秒长视频生成,最高 1080P 24fps 输出;提示词公式为「主体 + 场景 + 运动 + 声音描述」,声音描述含人声、音效、BGM 三类。
48 小时限时创作获海浪电影周 AI 黑客松金奖;创作灵感源于 Midjourney 生成的错误比例参考图,团队据此重构故事。
可灵 2.5 Turbo 高品质模式 5 秒视频从 35 积分降至 25 积分;实测复杂时序提示词理解与风格一致性显著提升,部分场景可与世界渲染大赛 Top 100 作品掰手腕。
阿里于 9 月 19 日开源角色动画模型 Wan-Animate,支持角色替换与动作迁移;模型可在 ComfyUI 运行,KJ 插件已适配,官方提供在线测试页。
Seko 新增生图模型选择(即梦 4.0、Flux.1 Kontext Pro、Nano 等)与粤语对口型,音色超 60 种、情绪 8 种;支持多主体一致性、连续分镜与首尾帧转视频。
提供 AI 汽车广告与香水广告的拆解教程,含视频与 PDF 解析文件;教程覆盖海螺首尾帧、保时捷案例等具体操作。
以 Wan2.2 为基底,用 Suno 作曲、Midjourney 出图、图生视频完成 15 天短片创作;正文附有角色设定提示词与鲁棒性提示词方法论。
用同图同提示词对海螺、可灵、即梦、Runway、Vidu、拍我六家做首尾帧转场测评,每项抽 6 次取最优;毛笔字转场海螺、可灵领先,语义遵循与风格转场海螺、Vidu 表现靠前。
百度蒸汽机 2.0 全系开放,Turbo/Lite/Pro 及有声版均升级,支持 720p/1080p、5s/10s 视频生成;中文语音细节还原度超 98%,支持多人对话音视频一体化生成。
Seko 支持超短提示词、2000 字脚本直出与首尾帧丝滑转场;一键成片可添加出演主体、修改分镜与配音,导出支持完整版或分镜版。
Genie 3 支持 24 FPS 实时互动、720p 画质与数分钟世界记忆;通过 20 万小时无监督视频训练,环境一致性为涌现能力。
Genie 3 支持 720p 分辨率、24 帧每秒实时导航,可维持数分钟一致性;相比 Genie 2 分辨率显著提升,并支持提示词生成世界事件。
可灵 1.6 新增多图参考功能,支持上传 1~4 张图片并指定主体、面部、服饰等元素;作者用该功能制作了短片《Out of the Frame》,并分享了保证人物背面正确、锁住人物特征等技巧。
Wan2.2 支持图生视频与文生视频,生成一次消耗 10 灵感值;7 月 29 日至 31 日每天可免费领取 100 灵感值。
WAN 2.2 开源并开放 GitHub、HuggingFace、魔搭及 ComfyUI 工作流;提示词公式为「主体 + 场景 + 运动」,进阶加入美学控制与风格化。
Midjourney 官宣视频首尾帧功能,作者用同一提示词对比 Vidu、即梦、可灵四类场景效果;即梦最忠实执行变形但动态弱,可灵善用动作与遮罩但回避细节。
横评 6 个视频 Agent 的剧情短片与产品广告两个场景;纳米 AI 与 AIpai 完成度最高,Flowith 输出网页而非成品视频。
Veo 3 文生视频一条提示词即可生成 AI 女团唱跳视频;作者给出通用提示词模版,并对比豆包、DeepSeek、Gemini 三款工具生成提示词的效果。
Vidu 参考生视频支持上传 1-3 张图定义角色与场景,生成 5s/1080P 视频;该功能将角色一致性从 Lora 等图像环节转移到视频维度,形成视频版“角色资产”。
Vidu Q1 参考生视频支持最多 7 个主体同台,多主体一致性大幅提升;提供 2 次免费 1080P 体验,附保姆级教程与多场景提示词案例。
AIMWISE 用 LoRA 与 ControlNet 为每个角色定制训练,解决 AI 动画中角色面孔漂移与动物动态难题;项目以分镜为本、声音先行,配合 PS/AE 逐帧精修完成全流程。
给出 7 段 Veo3 文生视频提示词,含超级英雄跳水、切玻璃水果 ASMR、美女 ASMR 等;提示词可直接复制使用。
投稿期 6 月 16 日至 7 月 7 日,设极简描述与场景速绘两赛道;一等奖 5000 元奖金加讯飞 AI 会议耳机,另有超级创作者与 VIP 会员长期激励。
Hailuo 02 在物理模仿与多主体交互上表现突出,空翻、拳击沙袋、台球碰撞等测试成功率较高;作者认为视频模型正从个体真实迈向交互真实。
每月 60 美元(年付约 48 美元 / 月)即可无限生成图片与视频;视频分辨率官方标 480p,实测约 720p,支持延长 4 次最长 20 秒。
Hailuo 02 开放灰度测试,默认生成 6s 768p 视频消耗 25 积分,1080p 消耗 80 积分;文生视频在体操动作等极限物理表现上优于可灵、即梦和谷歌 VEO 3。
MiniMax 分三阶段打造 Hailuo Video Agent,当前开放第一阶段模板一键生成;模板覆盖 AI 写真、宠物、电商、科普、像素风等品类,支持音乐、语音、字幕等工具调用。
Hailuo 02 支持文生视频与图生视频,分辨率 768p/1080p,时长 6/10 秒;AA 榜单评分全球第二,图生视频能力超过可灵 2.0 和 Veo 3。
视频模型 V1 以图像转视频形式上线,仅网页端可用,480p 输出,单次生成 4 个 5 秒视频;视频作业收费约为图像作业的 8 倍,Pro 及以上订阅支持放松模式。
Midjourney 发布首个视频模型 Video V1,仅支持图生视频,单次生成 4 个视频约 65 秒,最长可延长至 20 秒;分辨率仅 480P,但美学与风格保持出色,提示词理解与物理模拟处于二流水平。
实测结论为审美顶级但物理模拟与语义遵循一般,仅支持 5 秒 480P 生成;官方定价每月 10 美元,60 美元套餐可无限放松模式。
Veo3 生成视频需用英文提示词,人物说中文需用 "Says in Mandarin" 描述;用 JSON 结构化提示词可提升稳定性,Flow 平台支持场景延长保持人物一致。
即梦视频模型 3.0Pro(Seedance 1.0)在 ArtificialAnalysis Video Arena 文生视频和图生视频两项均登顶;实测中长镜头与多主体控制表现突出,但同屏多主体下马匹奔跑仍显僵硬。
用即梦 3.0 Pro 生成草莓拿破仑素材,再经 Gemini-2.5-pro 分析、GPT4.1 出分镜、VEO3-fast 生成;下一步计划用 PySceneDetect 检测帧差峰值实现卡点剪辑自动化。
原生 1080P、最长 10 秒,5 秒视频生成仅需 40 秒;API 价格 5 秒 1080P 视频 3.67 元。
《众神之战》由 1 个小团队用 2 个月全程 AI 制作完成,已上线红果、抖音、Reel.AI 等平台并在新加坡、法国展映;剧情融合孙悟空与奥林匹斯众神,画面精度对标 UE5。
即梦 3.0 智能参考支持改色、加字、改服饰且不受原图尺寸影响;新视频模型在多个分镜提示词下与可灵 2.1 大师版对比,并支持首尾帧。
腾讯混元联合腾讯音乐开源语音数字人模型 HunyuanVideo-Avatar,1 张图加音频或文案即可生成对口型视频;在线体验支持文本朗读与上传音频两种方式,音频限 14 秒内。
Gemini Pro 会员(20 美元 / 月)现已可使用 Veo3,学生会员可免费使用;实测 4 个案例,指令遵循度高,音效与画面同步,但口型与语音偶有不同步。
Veo 3 支持原生音频生成,对 AI Pro 和 AI Ultra 订阅用户开放;作者在 Gemini 与 Flow 平台实测文生视频,给出 10 个 8 秒主题的完整提示词。
Veo 3 首次实现音画同步生成,支持对白、唇动对齐与拟音音效;视频仍只有 8 秒,仅面向美国 Ultra 订阅用户开放,定价 249.99 美元 / 月。
Veo 3 支持 1080p/60fps 视频生成,首次实现原生音效与音画同步;已在 Gemini 应用向 AI Ultra 订阅用户开放,企业用户可通过 Vertex AI 调用。
Veo 3 支持原生音频生成,单次生成 8 秒视频,可通过 Gemini 或 Flow 访问;Flow 中 Veo 3 每次消耗 100 积分。
用 Suno V4 生成歌曲、Liblib 训练个人形象模型、可灵与即梦生成视频片段,再经剪映剪辑成 MV;全程三个半天完成,共生成约 20 条可用视频片段。
在 VBench-1.0 和 VBench-2.0 文生视频榜均登顶,超越 Sora 与 Runway;支持 1080p 与首尾帧百万运镜,1080p 5 秒视频最低 1.34 元。