AI生图口令实用模板:人物写真、商品图与小红书封面

先把口令写对,图才不会乱跑
很多人用 AI 生图时,最常见的问题不是“画得不够好”,而是“说得不够清楚”。同样是生成一张人物图,有人只写“高级感美女”,结果模型给你一张脸模糊、服装乱飘、背景不知所云的图;有人把人物、光线、构图、用途都写明白,出来的图就会稳定很多。AI 生图口令不是写作文,核心是把画面约束住。
好用的口令通常只需要四件事:主体是谁、场景在哪、画面什么风格、要避免什么问题。这四项写清楚,模型就知道该优先照顾什么。尤其是人物写真、商品图和小红书封面这三类需求,目标很明确,最适合用模板化口令。
如果你平时用的是 机灵助手 这类集成了多种模板的工具,会更容易上手,因为它本身就把常见场景拆好了。你不需要每次从零开始想词,只要先选对方向,再按你的内容微调,就能快速得到可用图。

一个通用公式,能覆盖大部分生图场景
先记住这个简单结构:主体 + 动作/状态 + 场景 + 风格 + 镜头 + 光线 + 细节 + 负面约束。它不是死公式,但足够应付大多数生图任务。比如人物写真不是只写“漂亮女生”,而是“20岁亚洲女生,长发,站在浅灰背景前,半身构图,自然微笑,柔和棚拍光,干净商业摄影风格,皮肤质感真实,避免畸形手指和多余肢体”。
商品图也一样,不要只说“高级香水”,而是要说清楚“单瓶摆放、白底或浅色石材台面、右侧柔光、微反射、产品标签清晰、商业静物摄影、画面留白”。小红书封面则更强调信息感,比如“竖版封面、强标题区、人物居中偏上、背景简洁、色彩统一、适合种草笔记封面”。
很多模型对“漂亮”“高级”“氛围感”这些词理解都很泛,最好搭配可视化描述:颜色、材质、光线、构图、镜头角度、景深。越具体,越不容易跑偏。也别一口气塞二三十个形容词,词越多不等于越准,反而会互相打架。
人物写真最怕脸不像,写法要盯住这几点
人物写真类口令,优先级通常是:人物特征高于风格,构图高于装饰,光线高于背景。也就是说,先把“人是谁”说清,再去写氛围。比如年龄段、性别、发型、服装、表情、姿态、肤质,这些都比“梦幻”“电影感”更关键。
适合直接套用的基础模板可以这样写:
模板:20岁亚洲女性,黑色长发,干净利落的妆容,穿浅色衬衫,半身正面构图,站在纯色背景前,自然放松的表情,柔和棚拍灯光,时尚杂志人像摄影,肤质真实,细节清晰,画面简洁高级,避免夸张五官、畸形手指、模糊脸部。
如果你想要更强的商业感,可以把“杂志人像摄影”改成“品牌宣传照”“职业形象照”“社媒头像”。如果想要更生活化,就换成“自然窗边光”“咖啡馆环境光”“日常街拍感”。同一个人像,只要把镜头和光线改掉,气质就会明显变化。
要是你发现脸总是生成得不稳定,可以加这类限制:面部五官比例正常、双眼清晰、鼻梁自然、嘴型正常、皮肤纹理保留、人物辨识度高。如果模型经常把人画得过度磨皮,就明确写“不过度美颜,真实皮肤质感,保留轻微毛孔和自然肤色”。
人物写真口令示例
示例 1:一位 28 岁亚洲女性,短发,穿米白色西装外套,站在浅灰色背景前,肩部以上构图,直视镜头,表情自信克制,柔和影棚布光,商业肖像摄影,干净留白,肤质自然,画面清晰,避免手部畸形和脸部扭曲。
示例 2:年轻男性,黑色针织上衣,靠窗侧坐,午后自然光,轻微虚化背景,低饱和电影感,35mm 镜头视角,人物眼神有情绪,适合个人主页封面,画面安静克制,避免过度锐化和夸张阴影。
示例 3:一位时尚感女生,长卷发,白色吊带裙,城市街头夜景,霓虹反光,半身近景,电影海报风,冷暖对比明显,皮肤真实,眼神坚定,背景有轻微散景,整体高级但不过曝。
如果你想批量做头像、简介图或者社媒封面,机灵助手里的人物写真模板会省很多事。先用基础模板出图,再按你的风格词微调,比如“职业感”“松弛感”“通勤感”“轻奢感”,不要一开始就堆太多抽象词。
商品图不是拍得贵,而是拍得清楚
商品图的重点和人物图完全不同。人物图看情绪,商品图看信息。买家想先知道:这是什么、长什么样、材质像不像、细节清不清楚、能不能放到电商详情页里。口令写法上,要把商品当主角,而不是当道具。
常用的商品图模板一般包含:产品类型、摆放方式、背景材质、光线方向、拍摄角度、清晰度要求。比如护肤品适合“白底、浅色石材、柔光、微距、标签正对镜头”;咖啡杯适合“桌面静物、窗边自然光、少量蒸汽、生活方式感”;首饰适合“深色背景、局部高光、微反射、质感明确”。
一个比较稳的写法是:
模板:单个产品居中摆放,浅色背景,柔和侧光,商业静物摄影,产品轮廓清晰,材质真实可见,标签文字区域留白,画面干净,没有多余道具,适合电商主图,避免畸变、脏污反光和背景杂乱。
如果你卖的是生活类商品,可以加一点场景感,但别把场景写太满。比如“桌面摆拍、书本、咖啡杯、窗边光”这类元素可以辅助气氛;但如果要做主图,还是要给商品留足视觉中心,不然容易喧宾夺主。主图看的是点击率,封面图才更适合强氛围。
商品图里有一个很实用的技巧:把“好看”拆成“可拍”。例如“高级感”可以换成“低饱和配色、浅景深、干净背景、材质高光受控”;“精致”可以换成“边缘清晰、标签可读、纹理完整、没有杂点”。这样模型更容易执行。
商品图口令示例
示例 1:一瓶精华液,正面朝向镜头,放在浅米色石材台面上,背景纯净留白,柔和侧逆光,商业产品摄影,瓶身质感清晰,玻璃微反射,标签区域清楚,整体简洁高级,避免多余道具和过强反光。
示例 2:一只白色陶瓷咖啡杯,放在木质桌面上,窗边自然光,轻微蒸汽,生活方式摄影,画面温暖安静,浅景深,背景轻度虚化,突出杯身釉面和咖啡液体质感,避免杯口变形和背景杂乱。
示例 3:一对银色耳环,深灰背景,局部打光,微距镜头视角,珠宝广告风格,金属高光柔和,细节锐利,边缘清楚,画面干净,适合详情页头图,避免多余阴影和结构变形。
如果你是做批量商品图测试,建议先统一背景和光线,再只替换产品词,这样更方便看效果差异。像 AI电商图片生成 这类需求,本质上就是让“商品信息更明确、拍摄方式更标准”,而不是把画面做得花里胡哨。
小红书封面要的是一眼看懂,不是信息越多越好
小红书封面最重要的不是“画得像摄影大片”,而是“让人停下来”。所以封面口令要同时照顾三件事:标题区、主体区、识别度。很多人生成封面失败,不是图不漂亮,而是标题没地方放、主体太小、颜色太散,最后发出去像普通插图。
写封面口令时,先明确用途:是美妆测评、穿搭分享、旅行记录、读书笔记,还是经验教程。不同用途的封面,构图逻辑不一样。教程类要给文字留白,种草类要突出人物或产品,情绪类可以更松弛,但标题区一定要有位置。
一个通用的封面模板可以这样写:
模板:竖版社媒封面,画面上方或左侧预留标题区,中间主体清晰突出,配色统一,风格干净有记忆点,适合小红书封面,人物或产品占画面主视觉,背景简洁,不要让信息太满,避免文字区域杂乱。
如果你想让封面更适合中文标题,可以明确写“留出大块空白区域用于后期加字”“标题区对比度高”“构图不要遮挡主要信息”。这样出图后,你后期排版会舒服很多。尤其是三张图、五张图连续发的时候,统一留白和统一色调,会比单张做得很艳更有效。
小红书封面口令示例
示例 1:竖版小红书封面,年轻女生坐在浅色背景前,穿浅蓝衬衫,右侧预留大块标题区,整体低饱和,干净明亮,人物表情轻松,适合穿搭分享,构图简洁,主体突出,避免背景元素过多。
示例 2:竖版封面,一瓶护肤品和一块面巾摆在白色桌面上,顶部留白用于标题,柔和自然光,清爽家居感,画面整洁,产品清晰,适合护肤测评笔记,避免复杂道具和杂乱阴影。
示例 3:竖版知识类封面,一位博主半身入镜,左侧留出文字空间,背景是浅米色渐变,轻微影棚光,整体高级克制,适合经验分享类内容,主体与标题区分明,避免画面信息过载。
如果你经常做封面,可以固定一套视觉语言:比如“浅米色底 + 深色标题字 + 一个人物主视觉”或者“白底 + 产品主视觉 + 红色强调色”。固定风格比每次换一种更利于账号识别。
口令里加上这些词,稳定性会明显高一点
生图不稳定,很多时候不是风格词不够,而是约束不够。下面这些表达很实用,几乎可以作为通用补丁加在尾部:
- 构图补丁:主体居中、半身构图、近景、留白充足、标题区预留
- 清晰度补丁:细节清晰、边缘干净、面部五官正常、产品标签可读
- 光线补丁:柔和侧光、窗边自然光、棚拍柔光、局部高光受控
- 风格补丁:商业摄影、杂志感、生活方式摄影、简洁高级
- 负面补丁:避免畸形手指、脸部扭曲、文字乱码、背景杂乱、过度磨皮
如果模型总是把画面做得太满,就加“极简背景、低元素密度、干净留白”。如果颜色太乱,就加“统一色系、低饱和、主色不超过三种”。如果主体不突出,就加“浅景深、主体优先、背景轻虚化”。这些词不花哨,但很管用。
还有一个容易忽略的问题:口令里最好少用“等等”“随意发挥”“多一些感觉”这类模糊表达。AI 不是读心术,越模糊越容易跑偏。你给它的自由度越大,结果越不可控。想让画面稳定,就把不想要的东西也写出来。
三个场景的口令,放在一起看更容易学会
如果把人物写真、商品图、小红书封面放在一起看,你会发现它们的写法差异其实很明确。人物写真更看重“人像真实感”,商品图更看重“展示清晰度”,封面更看重“阅读效率”。同样是“高级感”,三者落到词上完全不同。
人物写真里,“高级感”可以体现在棚拍光、肤质真实、服装剪裁、镜头焦段;商品图里的“高级感”更像材质质感、反光控制、背景洁净;封面里的“高级感”则是色彩统一、留白得当、主体明确。不要拿同一种口令套所有场景,否则图会看起来像没做完。
如果你做内容比较频繁,建议把常用模板整理成自己的词库:职业头像模板、生活写真模板、电商主图模板、种草封面模板。每次只改一两个变量,效率会高很多。像 机灵助手 这种工具,适合先从模板库里挑一个接近的,再改成你自己的版本,不用每次从零写。
也别忽视测试的重要性。同一个口令,换一个镜头、换一个光线、换一个背景颜色,效果可能差很多。最省事的做法不是“追求一次命中”,而是一次跑三到五个版本,对比哪一个最接近需求,再微调关键词。
把模板改成你自己的版本,才算真正能用
模板的价值不是让你照抄,而是帮你快速建立表达习惯。你真正要学会的是:看到一个需求,能迅速拆成可执行的画面要素。比如“我要一张适合发小红书的护肤封面”,就能马上想到:竖版、标题留白、产品居中、浅色系、清爽自然光、文字区不要乱。
再比如“我要一张职业头像”,就能马上想到:半身、正面、背景纯净、柔和棚拍、表情克制、衣着干净、皮肤真实、避免畸形和过度美颜。这样写出来的口令,通常比“给我一张高级头像”有效得多。
如果你常做图,不妨把下面这几个问题固定下来,每次生成前先过一遍:
- 这张图的主体是谁,必须突出什么?
- 这是给谁看的,用在哪个平台?
- 画面里必须保留什么,必须避开什么?
- 想要偏真实、偏商业,还是偏氛围?
- 标题区、留白区、重点区分别在哪里?
回答完这五个问题,再写口令,命中率会比直接上词高得多。AI 生图并不神秘,真正难的是把脑子里的模糊画面翻译成模型能执行的语言。只要你把语言写具体,图就更容易听话。



