跳到正文

从提示词到 AI 绘画:普通人 0 到 1 的极速入门指南

20:00 直播

国庆假期,韩煜东在 WaytoAGI 社区「晚八点共学」直播中,用近四个小时完成了一场面向普通人的 AI 入门课。上半场,他拆解了提示词的结构化写法,并现场演示如何用 AI 生成、调试一套属于自己的「系统提示词」;下半场则转入 AI 绘画,从两分钟做一张电商海报的「邪修」方法,讲到题材、主体、风格、景别、角度等完整的生图提示词体系。本文适合完全没接触过提示词、想系统学习 AI 对话与 AI 绘画的新手,也适合那些「感觉 AI 不好用」但说不清问题出在哪的日常使用者。

提示词不是一锤子买卖

韩煜东开场就纠正了一个常见误区:提示词不是简单输入一句话,而是「一个结构化迭代修改的过程」。很多人觉得 AI 输出效果差,问题往往不在模型,而在自己——「可能我们没有跟它们描述清楚我们到底想要什么」。

他以「我想发财,我该怎么做」为例,指出这种问法不可能得到满意答案。正确的做法是套用 AJ 在之前课程中分享的 CT 框架:C 是 Context(上下文),即背景信息;T 是 Task(任务),即具体诉求。

他现场演示了一段完整的提示词:我是一个 27 岁的男性,在北京做婚恋自媒体,通过引流私域、办线下见面会收会员费盈利,现有 1 万粉丝、月盈利 1 万块,想一个月挣到 10 万块,请指点流量和私域运营,用 Word 文档输出,并且要严格做市场调研和商业模式研究后再给答案。他逐句拆解:前几句是背景,目标是任务,补充说明是诉求的补充,Word 文档是格式要求,最后一句是输出规范。这样写出来的提示词,输出内容「50% 具有参考意义」。

普通人写提示词的五个步骤

韩煜东强调,大语言模型「非常喜欢结构化和组织化的东西」。他给出了普通人写提示词的通用格式,并称「只要你不是用于企业级的提示词,用这个格式够用了,到头了」。

第一步是设定角色。想买人体工学椅,就让 AI 扮演资深人体工学椅领域专家;想找法律文书,就说它是精通法律文书的专家。输入这句话和不输入,输出质量有明显差别。

第二步是交代任务和背景。以买椅子为例,要告诉 AI 自己的身高、体重、每天使用时长等具体情况,让它先了解你,再推荐椅子,而不是直接说「帮我推荐一把椅子」。

第三步是给出详细的分步指令,这主要针对复杂任务。第四步是强调约束准则,比如「实事求是,不要产生臆想,严格根据市场反馈和用户反馈推荐」。第五步是指定输出格式,比如「以表格形式给我」。

他提醒,背景信息要给全。演示中他忘了写预算,结果 AI 推荐了几把价格不菲的椅子,「这个后边大家自己去理解就可以了」。

系统提示词:让 AI 输出直接可用

普通提示词适合日常零碎需求,但如果你需要高频次、大量使用 AI 完成固定类型的工作,就需要一套「系统提示词」。韩煜东区分了两者:用户提示词是普通个体把诉求告诉 AI;系统提示词则像是给自动驾驶的车制定系统,「它会让大语言模型输出的内容质量更加的高」。

他现场对比了效果:把同一篇文章分别发给加载了系统提示词的对话和普通对话,前者直接输出一篇 70 分的公众号文章,「改一改可能改到 80 分我就发布了」;后者内容完全没法用。他总结:「AI 降本增效的点在哪里了?可能不是模型不行,而是我们打开的方式不对。」

系统提示词的使用方法很简单,三步:先有一个系统提示词,打开任意 AI 对话工具粘贴进去,回车。他特别提醒,要在新对话的第一条内容发送系统提示词,不建议在一个对话里设置多个系统提示词,如果有这种需求,建议去做智能体。

如何生成并调试一套系统提示词

很多人不是不会用系统提示词,而是不知道它从哪来。韩煜东在 WaytoAGI 知识库中提供了一个「原提示词」——即写系统提示词的提示词,直接复制粘贴给 AI 即可。

他现场演示了完整流程:以「皮肤科医生写健康科普文章」为例,把零碎想法全部扔给 AI——目标读者是小红书 20 到 30 岁有容貌焦虑的年轻女性,语气要通俗易懂又严谨权威,核心目的是科普、缓解焦虑、为私域引流。他强调,这个阶段「你脑子里有什么,千万不要藏着掖着,哪怕一个字你都给到他」。

AI 会据此生成一版系统提示词,但韩煜东直言,这版「可用性非常差」,真正的灵魂在于后续调试。他给出了几个关键技巧:

  • 让 AI 用 Markdown 格式输出系统提示词,这种结构化格式能让 AI 对话更高效。
  • 如果 AI 理解错了,直接指出问题。比如它输出了一篇小红书笔记而不是系统提示词,就告诉它「我不是让你给我写文章,我是让你给我做一个能写文章的系统提示词」。
  • 把生成的文章反馈给 AI,让它自己反思问题;也可以提供对标账号的内容,让它总结优点并内化到提示词中。
  • 警惕 AI 偷懒。他演示中遇到 AI 在提示词里写「保持不变」而不是完整输出,「你把这一版新的提示词扔到大语言模型对话里边,它又没有记忆,它怎么知道保持不变是什么意思呀?」这时要直接骂它,要求输出完整版本。

他坦言,调试过程很痛苦,「一个好的系统提示词它提质增效是真的,但是你在调试它的过程中很麻烦,这也是真的」。他建议花四五个小时打磨一套提示词是值得的,并推荐使用 Gemini、Claude 或豆包。

两分钟做一张能落地的电商海报

进入 AI 绘画部分,韩煜东先教了一个「邪修」方法:两分钟做一张双十一美妆海报。

第一步,在花瓣网等设计网站找一张参考图,截图保存。第二步,打开豆包,把截图粘贴进去,输入「帮我生成这个图片的 AI 绘画提示词,中文版本」。第三步,复制生成的提示词,在豆包或即梦中点击图像生成,粘贴提示词,选好比例,生成图片。

他特别演示了去水印的技巧:生成图片后点击「变清晰」按钮提升清晰度,等生成完成后,把这张变清晰的图片再点一次「变清晰」,然后右键第二次变清晰后的图片另存为,这样保存下来的图片没有水印。他反复强调:「仅供学习使用,我们真正要发的图片的时候还是要带上水印的。」

接下来是产品图合成。他推荐使用纳米 AI 的「纳米 P 图」工具:把场景图和产品图都上传,输入「把图 2 的商品放置到图 1 里面」这样一句简单指令即可。分层操作同理,告诉它「帮我把这张图片拆成分层的 PNG 素材」。他提醒,这类工具也需要「抽卡」——AI 生成一次效果不好,多生成几次选效果好的,这是 AI 圈的黑话。

AI 绘画的两条路径与提示词结构

韩煜东把主流 AI 绘画工具分为两条路径。「预制菜」路径以 Midjourney 和即梦为代表,大模型闭源,「提示词甭管再怎么写得差,它出来的图片好看」,但想做高度个人化的风格会比较吃力。「猛火现炒菜」路径以 Stable Diffusion 为代表,从选模型到调参数都要自己来,现在不建议本地部署,直接用 LiblibAI、吐司、卢米等平台即可。他提到,现在两条路径有融合趋势,比如字节新出的卢米平台就可以给即梦的模型加 Lora——Lora 是一个小模型,在大模型基础上让某种风格更稳定可控。

AI 绘画提示词的核心结构是:题材 + 主体 + 环境 + 风格 + 辅助元素。他特别强调,最重要的是题材、主体和风格。

题材源于具体场景:老板让做中秋节海报,海报就是题材;公众号文章需要配图,配图就是题材。主体可以是人、物,也可以是非具象的东西——他展示了一张以波浪为主体的图片,「它不是人也不是物,但它确实是主体」。环境包括地点和时间两个维度。风格分宏观(如赛博朋克、超现实主义)和微观(如某个作家、某部电影的风格),而且可以融合。

辅助元素由三部分组成:抽象化的表达(画面的情绪)、氛围词(如禅意、磨砂肌理)、质感词(能提升图片质量的关键词)。他特别解释了「抽象化的表达」:一个好的画面一定要有情绪,而情绪没法用一两个词表达,需要把对画面的感受写进去。

景别、角度与光线

景别可以用一句话概括:「远全中近特」。以人物为例:大远景中人在环境中非常渺小,主体是环境;远景中人是主体但依然很小;全景是「上有天下有地」,头顶和脚底都有空间;中景是膝盖往上、头部有空间;近景是胸部往上、头部有空间;特写可能只有一个脑袋;大特写则只有两个眼珠子。景别归根到底是「画面中有多大的人、多大的物,以及人和物与环境之间的比例」。

角度方面,常见的有俯拍、仰拍、平拍、航拍、垂直俯拍。AI 绘画中还有一些特殊角度和风格:产品视角、鱼眼镜头、微缩景观(人小景大,像小人国)、移轴摄影、慢门拍摄、延时摄影、双重曝光(两个图像没有融合却又结合到一起)。

光线方面,韩煜东直言:「现在所有的 AI 图像模型对于光线的理解都没有那么好。」专业布光术语在 AI 绘画里没有用,他推荐了几个自己常用的、能提升质感的光线词。他反复强调,学这些最终目的是「让画面有层次,让画面有厚度,让画面能用」——AI 绘画作品是拿来用的,不是拿来收藏的。

字体设计与文旅片实操

有观众问字体如何描述和控制大小。韩煜东以自己做的「杭州飘逸书法字体」为例拆解提示词:题材是字体设计,主体是「杭州」和字体,其余是辅助元素和风格。他提醒不要学死板,「如果你是新手,你就严格按照我那个来;你如果不是新手,你就想到哪说到哪」。

他演示了字体的商业落地流程:生成字体后点击「去画布编辑」进行抠图,把字抠出来,再上传建筑图片等素材,通过图层叠加让图片有层次和厚度。他以文旅片为例,把抠出的「杭州」二字与建筑图组合,达到商业落地的效果。他感慨:「我做了那么一堆工作,其实为的就是让这个图片有层次……我们要把东西真正地让它达到商业落地的场景,我不希望我教给你们的东西是没有用的。」

现场问答

问:字体如何描述?如何控制大小?

答:字体描述要明确题材、主体和风格。以「杭州飘逸书法字体」为例,题材是字体设计,主体是「杭州」和字体,其余是辅助元素。生成后可用「去画布编辑」抠图,再与其他图片图层叠加,让画面有层次。

问:抽卡是什么意思?

答:AI 生成一次效果不好,多生成几次选效果好的,就叫抽卡。

问:系统提示词怎么用?

答:一共三步:先有一个系统提示词,打开任意 AI 对话工具粘贴进去,回车。要在新对话的第一条内容发送。

问:Sora 等视频 AI 能用系统提示词约束吗?

答:不能。Sora 这类工具本身就有系统提示词,你没法改,你输入的提示词只是用户提示词。

问:提示词有没有通用的?

答:没有。尤其是系统提示词,每一个细分领域都要单独写一套,没有万能提示词。

要点回顾

  • 提示词是结构化迭代修改的过程,核心框架是 CT:C 是上下文(背景信息),T 是任务(具体诉求)。
  • 普通人写提示词五步:设定角色、交代任务和背景、给出分步指令、强调约束准则、指定输出格式。
  • 系统提示词能让 AI 输出质量大幅提升,使用方法是新对话第一条内容粘贴进去。
  • 生成系统提示词要用「原提示词」引导 AI 提问,把脑子里所有想法都喂给它,再通过反馈、对标文章不断迭代调试。
  • 两分钟做海报:截图参考图 → 豆包生成提示词 → 图像生成 → 二次变清晰后右键另存为去水印。
  • AI 绘画提示词结构:题材 + 主体 + 环境 + 风格 + 辅助元素(抽象化表达 + 氛围词 + 质感词)。
  • 景别「远全中近特」决定画面中主体与环境的大小比例;角度分俯拍、仰拍、平拍、航拍等,AI 绘画还有微缩景观、双重曝光等特殊风格。
  • 学 AI 绘画的最终目的是让画面有层次、有厚度、能落地使用。

直播回放260 分钟

播放器来自飞书妙记 · 在新窗口打开