从工作流到产品:用 Coze 把公众号抓取做成可落地的智能体
薛临风在 WaytoAGI「AI 智能体训练营」第七课中,围绕「落地」这一核心主题,讲解了如何用产品经理的视角拆解需求、用分治法搭建工作流,并完整演示了用 Coze 插件抓取公众号历史文章的全过程。课程还涉及应用界面搭建、UI 设计要点与数据绑定方法。适合已经掌握 Coze 基础操作、但不知道如何把技能转化为实际产品的学习者阅读。
落地三问:先想清楚做什么,再动手搭工作流
薛临风观察到,很多学员在学完前六节课后「脑子里一团想法,落到工作流的时候一团乱麻」。他给出的解法是:在动手搭建之前,先像给大模型写提示词一样,向自己提出三个问题。
第一问:痛点是什么? 他建议学员寻找那些「每周重复做三次以上」「需要打开多个网页才能完成」「因为门槛太高而一直拖延」的任务。他以公众号阅读为例:微信的阅读流体验不佳,用户关注了几百个公众号,却无法自动定时阅读最核心的几个;或者看到一个优质博主,想把他的全部文章扒下来,但不会写 RPA 和爬虫。这些都是典型的真痛点。
第二问:这事能干吗? 需要判断任务的核心难点是技术能力、逻辑推理计算,还是模糊理解生成。逻辑计算交给逻辑节点和业务节点,模糊理解和生成则依赖一套正确的提示词。同时要确认手里有没有原料数据——比如抓取公众号文章,原料就是你知道要看谁的公众号,以及它的链接。
第三问:做出来能用吗? 这里包含两层判断。一是成果是「止痛药」还是「维生素」:止痛药解决的是用户当下棘手的问题,维生素只是锦上添花,很可能不是真需求。二是输出结果的容错率:如果生成的是文章,容错率可以高一些;如果是数据报告,容错率就很低,需要在工作流里增加大量审核节点和确认节点来保证准确性。
薛临风提醒,很多人落地困难正是因为缺少这一层思考:「如果容错率不高,非常低,就是要求准确度非常高,那我们要干嘛?我们需要对工作流做大量的审核节点和确认节点,以保证输出的内容的准确性。」
分治法与 WHSI 结构:从最小结构开始搭建
薛临风强调,搭建工作流时不要一上来就堆节点。「先堆出最小结构,遇到什么卡点的时候把什么东西往上塞。」他以公众号抓取为例:先写一个提炼公众号信息的模型,发现信息从哪来?加一个链接让模型读文章。想获取用户所有历史文章?增加一个插件节点。为了处理得更好?加一个循环。担心效率慢?在 Coze 上直接建一个数据库。
他介绍了自己总结的 WHSI 结构:从宏观视角看业务(What),向下拆解为工作模式(How)、逻辑结构(Structure)和节点细节(Interface)。「从宏观去看,微观是业务流逐渐变成节点细节;从微观去看宏观,就是从节点细节了解这个世界的源语言,然后一步一步构建起这个巨大的东西。」
他还借用了 Spring AI 提出的智能体五大模式——路由、编排者、执行者、评估器、优化器——来说明工作模式与三大逻辑结构(顺序、分支、循环)的对应关系。但他特别提醒:「大家不要陷入到这个里边」,这些模式是思考工作流的底层语言,用来对齐沟通和理解,而不是需要死记硬背的专有词汇。
实操:抓取公众号历史文章的完整流程
本节是课程的核心实操部分。薛临风演示了如何用 Coze 插件「获取公众号文章列表」抓取任意公众号的历史文章。插件需要填写三个数据:cookies、fake ID、TOKEN。他详细讲解了这三个数据的来源和获取方法。
原理:正常公众号不允许外部海量扒取数据,但通过伪造请求包,可以让服务器误以为这是一个真实用户请求,从而返回信息。这三个数据就是用来伪造身份验证的。
获取方法:
- 注册公众号:没有公众号的学员需要先注册一个订阅号(免费),因为抓包操作要在公众号后台完成。
- 打开开发者工具:进入公众号后台,点击「写新文章」,再点击「超链接」,选择「公众号」,搜索目标账号(如 WaytoAGI)。此时按 F12(Windows)或 Command + Option + I(Mac)打开开发者工具,切换到「网络」标签,筛选
fetch请求。 - 找到请求包:在搜索结果中选中目标公众号后,右侧会列出请求记录。找到对应的请求包,其中包含全部三个数据:
cookies:在请求包的「标头」中找到,用于验证用户身份。fake ID:在「载荷」(Payload)中找到,字段名为fake_id。TOKEN:在请求包的 URL 参数中找到,是一串数字。
更简单的替代方法:
fake ID:打开目标公众号的任意一篇文章,按 Control + F(Mac 为 Command + F)调出搜索,输入varbiz,找到的字符串就是该公众号的fake ID。这个值是固定的,可以长期使用。cookies:使用 Chrome 插件「Cookie Editor」之类的工具,在公众号后台页面点击插件按钮,选择导出为header string格式,复制即可。注意cookies会因异地登录等原因变化,如果插件失效需要重新获取。
测试与参数设置:将三个数据填入插件节点后点击测试,即可返回文章列表,包含标题、发布时间、文章地址、封面信息等。插件默认每页抓取 5 篇文章,可以修改「页码」和「每页数量」参数,例如设置为每页 20 篇。
后续拓展:薛临风引导学员思考抓取成功后的应用场景——用循环节点批量抓取所有历史文章、存入多维表或数据库、用定时触发器检查公众号当天是否有更新并推送。他特别指出:「当你看到这类问题的时候,下意识的就会找到很多种解决方法。」
应用搭建:把工作流变成看得见的产品
薛临风指出,工作流搭得再长再大,100 多个节点别人也看不到,但应用搭得漂亮,一下子就能吸引人。他演示了如何创建带用户界面的智能体,并展示了多个案例:简化版 MBTI 人格测试(通过几个问题判断你像哪种动物)、小某书创作应用(包含热门笔记搜索、文案创作、爆款标题生成等功能)。
创建步骤:点击「创建项目」→ 选择「低代码」→ 选择「网页」模式。他建议初学者先创建 PC 端应用,因为移动端屏幕小,组件堆多了容易找不到。
UI 设计要点:
- 容器是核心:不要一上来就拖组件,先拖容器进行页面布局。容器决定元素是横排还是竖排、间距是自动还是固定,以及相对定位、绝对定位、固定定位等排布方式。
- 流式布局优先:尽量使用百分比而非固定像素,这样页面能自动适配不同浏览器窗口尺寸。
- 模板学习法:Coze 提供了官方模板,可以「把模板抠下来」,研究人家的布局模式,本质就是嵌套容器完成卡片结构排布。
工具推荐:薛临风推荐 Figma 和国内的 MasterGo 作为原型设计工具,它们的布局逻辑与 Coze 应用搭建高度相似。「你回头拿 Figma 或者拿 MasterGo 做出来一套自己的作品集,那去找工作比你用 PS 可能会更强一些。」他还提到,Coze 应用搭建完成后可以直接发布为微信小程序、抖音小程序或 H5。
数据绑定与交互:按钮可以绑定「点击事件」,执行页面跳转或调用后台工作流;文本组件可以绑定工作流输出的变量。悬浮效果通过位置偏移实现,例如设置向上位移 -36 像素,就能做出「推牌」的互动效果。
现场问答
如何生成日报? 日报本质上是查询数据库的过程。如果工作流中已经存储了数据,生成日报时只需从数据库里按日期匹配提取信息即可。周报则匹配日期范围。飞书多维表本质上也是一种数据库,官方提供了创建、删除、查询(get)等丰富操作。
如何接入已经做好的系统? 可以将工作流以 API 形式发布,在外部网站调用。如果只是需要一个对话窗口,也可以接入 SDK,直接嵌入网站。但薛临风提醒,API 对接存在一定难度,尤其是包含挂起节点(如问答、输入节点)的工作流,每次调用都会创建新的 session,遇到中断时对接会比较痛苦,需要程序员配置。
如何抓取公众号文章里的图片? 薛临风表示自己没有单独使用过这个功能,但指出微信公众号本身不允许外链直接获取图片,网上有一些伪造方法可以解决,难度不高,建议自行搜索学习。
如何设置悬浮效果? 选中组件,往下滑找到「悬浮」设置,点击后可以配置鼠标悬停时的动作。例如做一个位置偏移(向上位移 -36 像素),就能实现推牌效果。如果改为「点击」触发,则变成按钮的按下效果。
要点回顾
- 落地前先问自己三个问题:痛点是什么?这事能干吗?做出来能用吗?想清楚再动手。
- 搭建工作流用分治法:先搭最小结构,遇到卡点再往上加节点,避免一上来就堆出一堆稀碎的工作流。
- 抓取公众号文章需要三个数据:
cookies、fake ID、TOKEN,全部可以在公众号后台的开发者工具抓包获取。 fake ID是固定的,可以通过搜索varbiz快速找到;cookies会变化,失效后需要重新获取。- 抓取到文章列表后,可以用循环节点批量抓取、存入多维表或数据库、用定时触发器检查更新。
- 应用搭建的核心是容器布局,优先使用流式布局(百分比)而非固定像素,保证页面自适应。
- 按钮通过「点击事件」绑定页面跳转或工作流调用,悬浮效果通过位置偏移实现。
- 作业:初学者复现公众号文章抓取流程;进阶同学基于抓取设计产品,或搭建一个展示公众号信息的应用界面。
直播回放约 154 分钟
播放器来自飞书妙记 · 在新窗口打开