跳到正文

OpenCreator 深度解析:把创作变成流水线的一站式 AI 视频画布

讲师 小曼 · 20:00 直播

如果你是一个内容创作者,是否经历过这样的场景:写脚本用一个工具,生图换一个平台,配音再找另一个服务,最后剪辑还要回到剪辑软件——灵感在工具切换中被消耗殆尽。OpenCreator 的产品负责人小曼在 WaytoAGI 社区路演中分享了这款产品的解法:把创作本身还原为一个工作流,让创作者在一个画布上完成从灵感到成片的全过程。本文适合所有对 AI 视频创作、工作流工具感兴趣的创作者和产品爱好者阅读。

从创作痛点出发的产品定位

小曼用自己在广告公司的真实经历开场:一个纽约广告公司的职员,用老板的卡在 OpenCreator 上充值了 1,000 多美金,任务是给美国各州定制宣传短片。他的做法是把不同州的新闻报道链接丢进 OpenCreator,点一下运行,脚本、画面、声音、剪辑全部到位,几分钟就能交出一个可以 pitch 的片子。

小曼本人也是 WaytoAGI 社区的成员,去年积极参与各类视频比赛。她总结了自己作为创作者的两大痛点:心流效率。心流层面,多模型快速迭代让创作者面临选择压力,横跨 5~8 个平台做素材搬运,还要记得自己订了几家会员;效率层面,几乎所有工具都设置并行限制,无法获得及时满足感,且生成的好结果复用性差,每次创作几乎都要从零开始。

基于这些洞察,小曼给出了 OpenCreator 的定位:创作者真正需要的不是模型本身,而是一套保护创作心流、可以反复使用、可以控制的创作系统。她引用了一个比喻:人们日常生活中不会说「我需要电」,他们真正需要的是灯泡。

核心亮点:场景化生成、一键对比与批量运行

OpenCreator 的第一个核心亮点是场景化生成。小曼强调,OpenCreator 并不为某一个行业所定义,「创作视频本身是可以被拆解,而且可以被抽象的」。无论你来自哪个行业,只要有视频创作需求,理想状态下都能在 OpenCreator 组装出你的创意生产流程。她提到最近接触的小 B 端用户来自意想不到的行业——物流公司、亚马逊电商卖家,他们用 OpenCreator 量产公司内部宣传视频或品牌素材。

第二个亮点是一键对比模型。OpenCreator 接入了超过 20 个世界级模型,创作者可以在每个具备 AI 能力的模块下选择支持的模型,一键测试提示词对比效果。小曼说这非常必要,因为「我们每个月,甚至说每一天都在被新的创作类型模型的新闻干扰」,接入最热门的模型让创意工作者无需担心落伍。

第三个亮点是二创(Remix)场景。当一个创作者做出了团队内的生产力工具,队友可以基于这个框架修改参数,生成不一样的内容,创作不再是从零开始,而是基于已有沉淀。小曼用「Let me remix it」来概括这个场景。

第四个亮点是心流剪辑。OpenCreator 把剪辑原子做进了所有原子里面,实现「from generation to final cut, all in one uninterrupted flow」。精确剪辑、轻松调整大小、无缝添加文本,创作者可以在一处完成所有剪辑操作,无需在不同平台间切换。

第五个亮点是批量运行。OpenCreator 完全支持平行批量运行方式:你可以把完整故事版分裂成多个镜头传给生图,也可以点击全局运行让整个工作流批量运行。小曼展示了一个基于真实用户批量场景制作的视频,框架完全一样但内容不同。

上手实操:从模板到空白画布

入口方面,用户可以直接访问官网 opencreator.io,点击 start for free 进入主页。主页有几个 Tab:第一个是 templates,提供核心创意模板,点击 make it yours 可以基于现有工作流修改参数;第二个是 start from Scratch,适合对 AI 模型和工具已有了解的创作者,从空白画布搭建自己的生产力工具。

画布交互的基础是拖拽加连线。左侧罗列所有具有基础 AI 能力的原子,按文图、视频、语音等类别分类。比如第一步从文本撰写开始,拖出一个纯输入型文本,再拖出一个大语言模型 block,把同模态节点连接起来,就构建了一个最基础的 workflow。

运行分为单节点运行全局运行两种模式。搭建工作流时,如果不知道最终效果,可以点击单节点原子右上角的小运行按钮进行单任务测试。当工作流搭建好且你信任这个流程时,点击右上角的大 run button 进行全局运行。

运行过程中,中间节点会提供选择。小曼举例:故事版生成后,10 个结果可能只满意 1 个,选择它并继续即可,避免成本骤增。进度透明,可以随时点击 stop 查看结果。小曼说这是她作为创作者最喜欢的环节:「我去验收 AI 给我生成怎么样,然后我打开这个全局沉浸的模式去看结果的时候是特别爽。」

所有历史结果可以在 assets 区域找到,包括视觉类、音频类和文本类作品。资产还可以存储工作流、模板组或模块组合——保存原子组合及其参数,下次复用提效。小曼演示了把生成动画的小模板保存后直接拖到画布上使用。

支持的能力与模型矩阵

文字处理方面,OpenCreator 支持文生文和文本分裂。文本分裂解决了一个实际痛点:把成片的故事版剧本分裂成镜头一、镜头二这样的提示词,再给到生图,实现从文字到画面的可控转换。

图片处理包括文生图、图生图、风格一致的生图原子、去背景换背景(电商场景常用)、图片高清化、图片描述等。视频处理包括文生视频、图生视频加音效、视频高清化、对口型——对口型是 UGC 达人带货场景中非常常用的原子。音频方面可以生成背景音乐和 TTS 人声,目前接入 Eleven Labs 和 fish Audio 两家顶级厂商,分别适应专业创作型解说和达人推荐这类生活化、口语化场景。

剪辑器目前处于小 MVP 状态,包含轨道时长裁剪、音画合成、添加标题、适应平台尺寸等核心功能,小曼透露未来会有「非常惊喜的点」拓展。

模型接入方面,文字模型已接入最新的 GPT 5;图像有 top TIER 模型如 g.Key image、集梦生图;图像编辑集成了 Gemini、GPT、Flux 三大王者;视频模型厂商多样,VEO 3 还分为多个类型;语音模型有 Eleven Labs 和 fish Audio。

定价策略与成本估算

小曼建议,初期搭建工作流时使用单节点运行进行测试和选型,调好参数后再批量运行,效果更好也更省成本。目前有三个梯度的低价方案,每个梯度对应不同数量的素材生成量:第一梯度可生成约 40 个可灵 1.6 视频和 135 个 Flux image;第二梯度约 134 个可灵 1.6 视频和 462 个 Flux 1.1 Pro image;第三梯度是 556 个视频和 1,924 张 Flux。

小曼以一个经典的视频创作工作流为例做了成本拆解:前置输入是品牌名称和产品名,第二、三步是声图声文单元模型,token 消耗量不高(GB4O 最低约等于 2 credits);生图环节有价格梯度,比如 ideogram 3.0 比较贵,海螺和集梦效果不错且价格适中;生视频环节选可灵 1.6 和 Runway 粗测,10 个镜头约 1,800 credits。整个流程算下来大约 2,200 credits,运行一次大概花费 2~3 美金。

现场问答

Q:国内使用有什么困难?需要翻墙吗?注册有什么限制?

A:登录产品内不需要翻墙,没有 VPN 也可以进入和运行。注册支持 QQ 邮箱和谷歌邮箱,在注册页面直接输入 QQ 邮箱即可。如果登录或注册有问题,可以换谷歌浏览器尝试。YouTube 和微信视频号内容同步更新,国内用户可关注微信视频号「open Creator」。

Q:搭建工作流时能否预览费用或 token 消耗?

A:目前可以通过下拉列表大概估算原子消耗,团队正在优化预算管理功能。有用户建议在勾选模型时显示实时数字的虚拟计算器,小曼认为这是很好的建议。

Q:是否开放 API?

A:目前未开放 API,未来会考虑。团队希望了解核心用户场景,以便更好地开发。主持人元子补充了自己的需求场景:调好一个稳定模板后,只需要批量换素材产出切片,API 调用比在画布上操作更高效。

Q:商用有限制吗?

A:目前对用户生成内容没有商用限制,创作者需为自己的行为负责。大企业的定制化需求可以具体沟通。

Q:音乐 MV 支持中文吗?

A:支持。大语言模型不挑入参语言,可以直接让它输出中文歌词。虽然现有模板多为英文,但欢迎用户共创中文模板。

Q:为什么选择 workflow 形态而不是一键生成 agent?

A:小曼认为一键生成和对话框是交互形态,与 agent 能力不能混为一谈。选择 workflow 是因为它相对直觉还原心流 flow 的交互方向。她用一个做菜的比喻说明:一键生成像交代后厨做一盘西红柿炒鸡蛋,觉得口味淡想多加盐时,厨师又从切番茄开始——你只是需要调整盐的剂量,不需要再浪费一个番茄和一个鸡蛋。未来不排除结合 agent 能力,但会以用户为导向,在恰当节点引入。

要点回顾

  • OpenCreator 定位为「内容创作者的一站式画布」,核心是保护创作心流、支持工作流复用,让创作变成流水线。
  • 五大核心亮点:场景化生成、一键对比模型、二创(Remix)分享、心流剪辑、批量运行。
  • 上手路径:从官网 opencreator.io 进入,推荐新用户从 templates 模板开始,基于成熟 SOP 修改参数;进阶用户可 start from Scratch 从空白画布搭建。
  • 运行机制:单节点运行用于调试选型,全局运行用于高效产出;中间节点可人工选择结果,避免成本骤增;assets 区域可存储历史结果和原子组合。
  • 能力覆盖:文生文、文本分裂、文生图、图生图、风格一致生图、去背景换背景、图片高清化、文生视频、图生视频加音效、对口型、背景音乐、TTS、剪辑器。
  • 模型矩阵:接入 GPT 5、g.Key image、集梦、Gemini、Flux、VEO 3、可灵、Runway、Eleven Labs、fish Audio 等 20+ 世界级模型。
  • 定价:三个梯度低价方案,一个经典视频创作工作流(10 个镜头)运行成本约 2~3 美金;VEO 3 限时低至 2 折。
  • 团队为三人小团队(小艺、筱漫、大海),正在招募全站开发、市场和运维人才,联系方式见 WaytoAGI 路演栏目第四期文档。

直播回放92 分钟

播放器来自飞书妙记 · 在新窗口打开