跳到正文

一站式 AI 创作实战:ListenHub 2.0 六大功能全拆解

讲师 国荣 · 20:00 直播

2026 年 1 月 29 日,WaytoAGI 社区邀请 ListenHub 内容负责人国荣和英语教师培训师吴熳,在「晚八点共学」直播中完整演示了 ListenHub 2.0 创作平台的六大功能——解说视频、PPT、AI 播客、TTS、音色克隆和 AI 生图,并展示了如何用多个功能组合完成一个新年拜年视频。无论你是内容创作者、教育工作者,还是想用 AI 做点好玩东西的普通用户,这篇文章都能帮你快速上手这套一站式创作工具。

产品概览:一个平台,六种能力

国荣介绍,ListenHub 团队创业刚满一年,2.0 版本呈现了目前完整的产品形态。平台左侧展示所有产品,右侧展示具体产品的能力和模板,还包含邀请好友、基本设置和购买会员等入口。用户直接在浏览器输入 listenhub.ai 即可进入。

平台包含六个主要功能:解说视频、PPT、AI 播客、TTS(文本转语音)、AI 生图和音色克隆,另外在实验室里孵化了一个音乐相关功能。国荣特别强调,这些功能不是孤立的——「站内所有内容逻辑上都可以互相转化」,视频可以转成播客,播客可以转成视频,PPT 也能转成播客,图片同样可以转化成播客或视频。

解说视频:两步生成知识类视频

解说视频功能面向近年来在抖音、小红书、B 站持续增长的知识类内容需求。国荣以 B 站 up 主小约翰可汗为例做了演示:用一张仓鼠形象参考图框定主体,一句提示词指定主题,选择风格和音色,即可生成一段图文形式的解说视频,生成时间约 2 分钟。

操作上只需两步:写提示词 + 垫参考图。提示词里用一句话框定主体形象和视频主题,系统会通过模型和搜索功能自动识别网络上有公开信息的知名人物语气或文本风格,无需详细描述。目前有两种模式可选:知识图解适合科普类内容,故事演绎更偏向儿童绘本的展现形式。图片比例支持 16:9、9:16 和 1:1,语言支持中文、英文和日语,不同语言有不同音色。国荣分享了一个小技巧:可以让中文音色说英文,或让英文音色说中文,「可能会有在效果上一些很神奇、很奇妙,有的时候反而更好听的结果」。今年平台还计划拓展西班牙语、法语等更多语言。

生成的视频可以导出为视频、PDF 或 PPT 格式。界面下方还提供了三个 idea 示例,点击即可自动填入提示词,方便新用户快速尝试。

PPT:从自由发散到精准控制

PPT 功能的使用方式和解说视频基本一致,同样支持粘贴链接、上传 PDF 或图片,后台知识系统会自动解析内容。吴熳作为 ListenHub 的重度用户,分享了三种提示词写法,对应三个控制层级。

几乎无控制:只需写清诉求、受众和内容设计方向。吴熳以「创作一个关于立春的 PPT」为例,提示词只有三句话——创作诉求、受众是三年级小朋友、设计有趣的立春活动。AI 自由发散后生成了包含立春习俗、科学知识、课堂任务(如 AR Hunt)的完整课件,还自动配上了她上传的 IP 形象「吕将军」和「小熊猫」。

半控制:在提示词中规定内容大纲。吴熳制作「现在进行时」教学 PPT 时,明确要求包含定义、基本例句、题目和拓展用法,AI 生成的内容更有条理,配图与文字匹配度也更高。

精准控制:用 DeepSeek 辅助生成详细提示词。吴熳的方法是先让 DeepSeek 写出完整的教学大纲,从第一页到第十页都规定好内容,再粘贴到 ListenHub 中。「用 AI 来驱动 AI」这个技巧让做东西的难度显著下降。她强调,只要把两个 IP 参考图放在一起,生成结果的一致性可以保持 80% 左右。

关于成本,吴熳实测做一份 PPT 大约花费 150~230 积分,会员可导出音频、视频、PDF 和 PPTX 格式。国荣补充,PPT 的页数可以通过提示词控制,他还展示了一份用「极繁提示词」生成的 5 页商务咨询 PPT——每一页的图表类型(瀑布图、矩阵图、能力评估表)、排版规则和画面描述都在提示词中写清楚,生成结果基本完全遵循指令。目前 PPT 的修改功能已排上开发日程,很快会上线。

音频组:音色克隆、TTS 与 AI 播客

音色克隆提供两种方式:上传音色适合克隆现成声音(如某段录音),对话式克隆则适合人在电脑或手机前直接说话录制。国荣现场演示了对话式克隆,几秒钟就获得了一个自己的克隆音色。

TTS 功能支持直接输入文字生成语音,也可以上传链接、图片或 PDF 文件让它念出内容。对于长文本,可以开启 AI 润色功能,让书面化的文字变得更口语化。

AI 播客功能支持速听深度两种模式,语言同样支持中英日。用户可以指定任意两个声音进行对话,例如国荣演示了用罗永浩的声音和自己一起聊当天财经新闻,1~3 分钟即可生成。更进阶的用法是粘贴站内其他内容的链接——比如把刚生成的解说视频链接放进去,就能让两个声音围绕该主题做一期播客节目。

AI 生图与音乐:从表情包到拜年视频

AI 生图功能支持参考图 + 提示词的方式生成图片。国荣以给创始人橘子设计 Q 版长草颜团子形象为例:上传头像作为参考图,输入提示词,选择比例和品质即可生成。表情包适合 1:1,一般照片用 16:9,海报用 3:4;品质方面 2K 够用,需要保持文字一致性时建议选 4K。

提示词方面,国荣建议使用 JSON 结构化模板以便更细致地控制参数,且因为背后用的是 Nano Banana Pro 模型,「对英文的识别还是相对好一些」,英文提示词识别效果更佳。他还演示了通过 scale 功能批量生成 16 张 1:1 拜年图片,并建议做商业化表情包时生成 100 张再从中挑选。

音乐功能在实验室中孵化,支持简单和高阶两种创作方式。简单用法是直接输入风格和场景要求,如「一首 city pop,符合 80 年代日本街头风格」;高阶用法可自行规定标题、音乐风格、歌词,甚至添加负向提示词(如不希望出现二胡音色)。国荣现场播放了一首用刘德华音色改编的「恭喜发癫」,并介绍了配套的视频功能(GIF 配乐生成视频)和翻唱功能(上传歌曲按提示词改编)。

新年案例:三个功能组合出拜年视频

国荣最后演示了一个完整的新年案例——用 ListenHub 给创始人橘子制作拜年视频,至少用到三个产品功能:

  1. 音色克隆:上传橘子的声音文件克隆其音色。
  2. AI 生图:上传橘子照片和刘德华拜年照片,融合生成拜年形象;再用一套「赛博但中国乡土」风格的提示词模板生成拜年背景图。
  3. 解说视频:将生成的拜年形象作为风格选项,配上克隆的橘子声音,生成一段约 5 页的拜年解说视频。

国荣透露,春节期间 ListenHub 将推出购买页面折扣活动,同时有连续 11 天的打卡活动,每天在网站签到可获得积分赠送礼包。演示案例的模板和提示词会整理后分享到社区群。

现场问答

Q:PPT 能修改吗? A:修改功能很快就会上线。团队已经听到很多用户对 PPT 和解说视频图片微调的需求,功能已排上开发日程。

Q:生成 PPT 大概花费多少积分? A:吴熳实测做一份 PPT 约 150~230 积分,会员可导出音频、视频、PDF 和 PPTX 格式。

Q:PPT 只能生成 10 页吗? A:不是。可以通过提示词控制页数,国荣演示了只生成 5 页的案例,同理也可以生成 20 页。

Q:为什么用 PDF 生成 PPT 会失败? A:国荣推测可能是 PDF 中的某些词触发了后台安全拦截系统,下播后会排查。用户遇到问题可通过官网 support 邮箱反馈。

Q:生成图片会有错字吗? A:吴熳表示因为用的是 Banana 4K 模型,几乎没看到过错字,但 AI 毕竟有随机性,不能 100% 保证。

要点回顾

  • ListenHub 2.0 包含解说视频、PPT、AI 播客、TTS、AI 生图、音色克隆六大功能,另有实验室孵化的音乐功能。
  • 解说视频只需提示词 + 参考图两步,约 2 分钟生成,支持知识图解和故事演绎两种模式。
  • PPT 提示词分三个控制层级:几乎无控制、半控制(规定大纲)、精准控制(用 DeepSeek 生成详细提示词)。
  • 音色克隆支持上传文件和对话式两种方式;AI 播客支持速听/深度模式,站内内容可互相转化。
  • AI 生图建议用 JSON 结构化提示词 + 英文描述,批量生成用 scale 功能。
  • 音乐功能支持简单一句话生成和高阶自定义,还有 GIF 配乐视频和翻唱功能。
  • 新年拜年视频案例串联了音色克隆、AI 生图和解说视频三个功能。
  • 春节期间有购买折扣和连续 11 天打卡送积分活动。

直播回放96 分钟

播放器来自飞书妙记 · 在新窗口打开