学习模式

【提示词创作第四十九节】赋予AI角色“活人感”的3个核心提示词法则

2个月前 3招告别AI人物塑料感 作者:西瓜
AI绘画
提示词技巧
人物真实感
光影渲染
微表情控制
导语:为什么别人的AI像活人,你的却总是一眼假?

在AI创作的过程中,我们经常会遇到一个痛点:

为什么别人生成的AI人物仿佛拥有呼吸,质感细腻如同摄影大片;而我们自己做出来的人物,却总是带着一种无法名状的“一眼假”?

这种“假”,有时表现为面部如同涂了层厚重油脂般的油腻感,有时则是空洞的眼神和完美却僵硬的表情。这种现象在视觉心理学中被称为“恐怖谷效应”边缘的徘徊——它像人,但缺乏生命的灵魂。

其实,AI角色太僵硬,往往不是因为你的底层模型不够强大,而是因为在提示词的构建中,忽略了那些构建“真实感”的基石。今天,我们将拆解3个行之有效的核心方法。掌握它们,你就能快速让你的AI角色褪去机械感,拥有真正的“活人感”。

第一招:注重细节表达,用“微表情”与“潜动作”注入灵魂


AI角色太僵硬、一眼假,根本原因往往不是模型不行,而是你忽略了“人之所以为人”的生理细节。很多创作者在写提示词时,只会写“一个男人在思考”,结果AI生成的往往是一个眼神空洞、宛如定格木头人的画面。

描述想让人物表情自然、情感丰富的关键,在于微表情和身体语言。我们直接拿你生成的这张堪称电影级标杆的图来拆解,看看真正的“活人感”是如何通过细节构建出来的:

核心细节 1:让神态更丰富——描述情绪的“流动”与“切换”

现在的AI视频工具已经非常强大了。如果你现在去生成一个视频,在图片合适的情况下,哪怕提示词写得很简单,出来的画面皮肤质感和光影也往往很真实,早就告别了以前那种油腻的“塑料假人”。

那为什么我们做出来的视频,看着还是有一种说不上来的“AI味”?

因为现在的“假”,已经不再是皮囊的假,而是状态的假。

为了让你秒懂,我们直接来看一组“复古西装男坐在沙发上读信”的对比案例。

图片由midjourney v8.1生成,提示词如下:

Cinematic movie still, medium shot. A relaxed man in a 1930s vintage linen suit sitting on an antique velvet sofa in a grand sunlit room. In the visual style of the movie Atonement (2007) with dreamy soft focus. Natural body posture, leaning forward, holding a handwritten letter, his other hand gently resting on his chin. Subtle asymmetrical facial expression showing deep thought. Soft nostalgic lighting, dust motes dancing in the sunbeams with a soft ethereal glow, diffusion lens filter, warm golden and soft green color palette, 35mm film grain, storytelling composition.

反面案例:精致但空洞的“图库素材”

很多新手想表现人物思考,就会直接输入这样的提示词:

“一个穿着亚麻西装的男人坐在复古沙发上,读信,思考,电影级灯光。”

反面案例

AI很听话,出来的画面质感确实不错。但你仔细观察人物的状态——他长得很完美,动作也很标准,但就是没有情绪。

虽然他手托着下巴,但脸部肌肉缺少运动。在几秒钟的视频里,他没有情绪的递进,没有因为读到信件内容而产生的内心波澜,托着下巴的手也像个死板的支架一样僵硬。这叫“有皮囊,无灵魂”。

不要只给AI一个静态表情指令。人类在深度思考时,情绪是复杂且不断流动的。

看看在这张图中,我们可以如何深化男子的神态:

起始状态: 眼神精准聚焦信件,眉毛微蹙(专注于文本)。

过渡状态: 读到某一段落,眼神产生微小的跳动(在重读或跳过),眼睑轻微眨动,睫毛被阳光照亮。

神态高潮: 读完最后一行,视线缓慢抬起,看向镜头外(可能是怀旧、担忧、决策或情感爆发),眼神中流露出更复杂的故事感。嘴唇随之从轻轻闭合变为微张,再到因压抑而紧闭。

视频动态提示词建议:
在视频生成时,不要给静态结果,要描述情绪的发生过程:

Thoughtful gaze shifting from reading text to look nostalgic off-camera, eyes blink softly (with illuminated lashes), subtle eyebrow furrowing and relaxing, lips press closed with deep Repression, then slightly part showing hesitancy. (若有所思的视线从阅读文本转移到镜头外怀旧,眼睑轻眨,眉毛微蹙又放松,双唇因深沉压抑而紧闭,随后微微张开露出犹豫。)

2. 引入身体语言的“潜台词”

原本的“手托下巴”动作虽然真实,但略显静态。为了让动作拥有更高的灵魂感和物理真实度,我们需要把静态的“托”改为动态的“摩挲”。这是人类在极度专注、焦虑或犹豫时的不自觉生理反应。

在摩挲动作上下足功夫:

经典摩挲下巴: 描述手指(比如食指和拇指)在下巴或下颌线上缓慢、有节奏地滑动和摩挲。这是不自觉的思考动作。

更细腻的摩挲嘴唇: 食指指尖不自觉地在下嘴唇的边缘或嘴角轻轻摩挲。这个动作不仅极具电影感,还能极好地展示指尖材质和面部皮肤的复杂物理交互。

物理效果结合: 由于手指的摩挲,面部皮肤会有细微的物理移动,亚麻西装的衣袖也产生更复杂的动态褶皱。

视频动态提示词建议: 不要只写“坐着”,要加上伴随动作和重心变化:

Dynamic hand posture, fingers slowly and rhythmically massaging the chin and lower jawline, fingertips gently rubbing the lower lip line. Motion creates skin movement on his face and additional dynamic folds in his linen sleeves. (动态手姿,手指缓慢且有节奏地摩挲下巴和下颌线,指尖轻轻揉搓下嘴唇线。动作在脸部产生皮肤移动,并由于姿势变化在亚麻袖口产生额外的动态褶皱。)

将俩个提示词结合生成



第二招:打破“摆拍感”,用“环境对抗”让动作彻底活起来


现在的AI生成技术,无论是做图还是做视频,最容易暴露“AI味”的地方就在于人物的动作和体态。

为了讲透这个核心技巧,我们将分两步走:先教你如何在“静态图片”中定格真实的生命力,再教你如何在“动态视频”中赋予人物合理的逻辑。


第一阶段(图片篇):告别“假人走秀”,制造静态画面里的“抓拍感”

在用AI生成静态人物图片时,新手最容易犯的错误就是让人物处于一种“真空摆拍”的状态。

如果你只在提示词里写“一个女人在花园里散步”,AI确实会生成一个女人。但你会发现,她的身体重心永远在正中间,左右手对称摆动,衣服纹丝不动。这就导致人物看起来像是一个在镜头前刻意凹造型的“T台模特”,毫无真实生活的气息。

破解方法:引入“环境对抗”与“物理惯性”

想要让图片里的人物“活”过来,你需要让她和周围的环境发生真实的物理碰撞。我们来看看这张完美的案例图。

提示词如下:

Cinematic movie still, medium shot. A beautiful Chinese woman in a light linen 1930s summer dress strolling through a lush sunlit garden. In the visual lighting style of the movie Atonement (2007). Fluid movement, captured mid-stride. A gentle breeze is blowing. Her arm is naturally raised to hold her sun hat, head tilted slightly against the wind, black hair gently blowing. Unforced, candid dynamic pose, realistic Asian features. Warm golden hour light, glowing highlights, soft ethereal diffusion, rich cinematic colors, 35mm film grain, storytelling.(电影剧照,中景镜头。一位美丽的中国女性,穿着轻薄亚麻1930年代夏装,在阳光明媚的葱郁花园里漫步。采用电影《赎罪》(2007)的视觉灯光风格。流畅的动作,在步伐迈出一半时抓拍。微风吹过。她的手臂自然抬起按住太阳帽,头部迎着风微微倾斜,黑发轻轻飘动。不造作的、抓拍感的动态姿势,逼真的亚洲特征。温暖的黄昏光线,发光的高光,柔和空灵的漫反射,丰富的电影级色彩,35mm胶片颗粒感,充满故事性。)

这张图之所以看起来充满旺盛的生命力,仿佛是电影里截取的一帧,正是因为它把这两点做到了极致:

1.引入环境对抗:

真实的世界是有风、有阻力的。我们没有让人物傻傻地直立行走,而是引入了“微风”。因为有风,人物为了防止帽子被吹跑,下意识地抬起了一只手按住草帽,同时头部迎着风微微倾斜。这个“对抗风”的不规则肢体动作,瞬间打破了AI习惯生成的对称僵硬感。

2.制造物理惯性:

真实的动作是连贯的,是有重量的。我们在提示词中要求AI捕捉“步伐迈出一半的瞬间”。注意看她的裙摆,它不是软塌塌地垂在腿边,而是因为向前的动作,向后扬起了一个极其自然的弧度。

在静态图片中,加入了这种不经意的小动作和物理重量感,摆拍感就彻底消失了。

第二阶段(视频篇):告别“盲目漫步”,赋予动作连贯的“内在逻辑”

当我们在静态图片里把人物的姿态调教完美后,下一步就是生成视频。但这个时候,新的问题又出现了。

现在的AI视频大模型(如即梦、可灵等)已经非常强大,哪怕你只写一句简单的指令,人物走起路来也基本不会出现以前那种“机器人的卡顿感”了。画面很流畅,裙摆也会飘。

既然不僵硬了,那为什么视频看着还是“假”? 因为现在的“假”,已经变成了动作缺乏逻辑的假。

常见的AI视频翻车现场(空镜素材感): 你会发现,视频里的女孩虽然在走路,但走着走着,原本举着帽子的手突然毫无缘由地放下了,或者眼神开始毫无目的地左顾右盼。她很美,动作也很顺滑,但整体像是一个没有任何剧情交代的“唯美空镜”。她不知道自己为什么要拿帽子,也不知道风从哪里吹来。

破解方法:用“环境因素”锁死动作的动机

在AI视频中,千万不要让人物“盲目散步”。既然我们在图片里用了“风”来制造抓拍感,那么在视频里,我们就要用“风”来充当导演,逼迫人物产生连贯的下意识反应。

不要只让AI去执行“走路”这个宏观动作,我们要用提示词把因果关系写清楚:

抄作业时间:高级动态提示词公式 下次在生成视频时,试试这样写:

“在步伐迈出一半时抓拍,一阵微风吹过(交代环境因),她下意识地抬起手臂按住太阳帽防风(交代动作的果),身体重心微微前倾,轻薄的裙摆随风和向前的步伐自然飘动(交代物理状态的延续)。”

当你加上这个设定后,视频里的角色就不再是随机分配动作的“无脑NPC”了。她举着手不再是无意义的摆拍,而是为了“护住帽子”;她的身体前倾也有了合理的支撑。

一句话总结第二招:

无论是做图还是做视频,都不要让你的角色在毫无阻力的真空里行动。给画面加点风,加点阻力,让人为了对抗环境做出“不经意的物理反应”。 一旦动作有了物理的惯性和符合常理的动机,你的作品就真正具备了电影级的真实感。



第三招:精细化光影处理,用“局部光源”与“冷暖对比”拒绝油腻


为什么生成的AI人物,五官再精致也总是透着一股“塑料感”?原因通常出在光影上。AI默认喜欢用“大平光”,光线直直地照亮整张脸,没有阴影过渡,人的脸就变成了一张平整的贴图。

想要去除这种一眼假的油腻感,我们可以分两步调整:先在图片里处理光影结构,再去视频里解决光影的移动。

第一阶段(图片篇):打好局部光,塑造立体骨相

做图时,不要让光照亮画面的每一个角落。我们通过两张图的强烈的对比来秒懂这个概念。

反面案例:大平光下的“塑料感”

看看上面这张反面案例。画面虽然清晰唯美,但因为没有明暗对比,高光死死地扣在额头和鼻尖上,产生了极其廉价的油腻塑料感。中国女性精致的骨相在没有任何阻挡的光线下,变成了一张没有任何起伏的平面。

正面案例:利用阴影雕刻立体感

提示词 (Prompt):

Cinematic movie still, medium shot. A thoughtful Chinese woman in a 1930s light linen vintage dress sitting at an antique wooden desk in a dark library. In the visual style of the movie Atonement (2007). Practical lighting from a warm, glowing antique brass desk lamp illuminating her face and hands, contrasting with the cool, deep emerald shadows of the surrounding room. Matte skin texture. Ethereal soft focus glow around the lamp, 35mm film grain, storytelling composition. --ar 16:9 (电影剧照,中景镜头。一位若有所思的中国女性,穿着1930年代浅色亚麻复古连衣裙,坐在黑暗图书馆的古董木桌旁。采用电影《赎罪》(2007)的视觉风格。来自一盏温暖、发光的古董黄铜台灯的实用光源照亮了她的脸和手,与周围房间凉爽、深邃的祖母绿阴影形成对比。哑光皮肤纹理。台灯周围空灵的柔焦辉光,35mm胶片颗粒感,充满故事性的构图。)

然而,好的光影处理应该是这样的。这张台灯下的女孩图之所以看起来非常自然、毫无AI味,主要做对了这三点:

1.学会留白与“藏光”(局部光源):

图里没有使用全局照明,而是只用了一盏复古台灯当主光源。它仅仅照亮了女孩的侧脸和双手,把背景留在了深邃的阴影里。有明有暗的戏剧性对比,自然就能展现出面部骨骼的真实起伏。

2.冷暖色彩对比:

光线是有温度和层次的。台灯打在脸上是暖黄色的光(暖光),而背景书架呈现出幽暗的蓝绿冷光(冷光)。这种“前暖后冷”的色彩对抗,能很好地拉开空间层次,让场景看起来更真实。

3.限定皮肤材质(哑光皮肤):

想要从根源上去油腻,必须在提示词里加上强制指令:matte skin texture(哑光皮肤)。暖光打在细腻的哑光皮肤上,产生的是柔和的漫反射,绝不会出现那种晃眼的塑料高光。

第二阶段(视频篇):底图定生死,视频提示词学会“做减法”

我们在图片阶段花那么大精力调教光影,就是为了在视频阶段“偷懒”。

现在的图生视频大模型非常聪明,它会完美继承你上传的第一帧图片的全部质感。如果你只需要人物做一些小幅度的动作,千万不要把视频提示词写得太复杂。

新手误区:画蛇添足的过度描述
很多新手在有了完美的底图后,生成视频时依然会把图片提示词里的“冷暖对比”、“哑光皮肤”、“复古台灯”全部再抄一遍,甚至加一堆华丽的辞藻。
这其实是在帮倒忙。

极简操作:只交待微小的物理动作

既然图片已经足够真实,环境和光影都已定型,你在视频提示词里只需要做一件事:告诉它动哪里。

视频极简提示词参考(基于台灯女孩底图):

“Subtle breathing, gentle typing motion, keeping original lighting.”
(轻微的呼吸,温柔的打字动作,保持原有光影。)

你看,就这么短。

只要底图的质感足够硬,AI就会顺着原本的物理逻辑去自然推演。女孩胸腔会微微起伏,手指会在键盘上轻敲,而台灯的阴影也会极其自然地附着在她的哑光皮肤上。

一句话总结这招:
把90%的精力放在打磨“底图”的光影和质感上。只要图片足够像活人,在生成小幅度动态视频时,学会给提示词“做减法”,AI自然会还你一个极致逼真的电影镜头。



总结:赋予AI“活人感”的三大核心心法


1. 演戏要给“潜台词”:用微神态与下意识动作打破摆拍

别写: “思考”、“难过”、“直视镜头”。

要写: 眼神的转移(如“视线缓缓抬起”)、面部肌肉的微动(如“眉头微蹙又放松”)、以及物理惯性带来的下意识小动作(如“手指有节奏地摩挲下巴”)。

核心: 情绪是流动的,给人物加上内心戏,摆拍感自然消失。

2. 动作要给“对抗力”:用环境阻力建立物理逻辑

别写: “在花园散步”、“走动”。

要写: 环境因素(如“微风吹过”)、对抗环境的动作(如“下意识按住帽子防风”)、以及抓拍瞬间(如“步伐迈出一半、身体微微前倾”)。

核心: 不要让角色在真空里走秀,给动作加上合理的物理逻辑和动机,视频就不会像无脑的空镜素材。

3. 光影要学会“藏”:局部打光雕刻骨相,视频果断做减法

别写: “明亮均匀”、“完美无瑕的大平光”。

要写: 局部光源(如“复古台灯”)、冷暖对比(如“暖脸冷背景”)、并强制锁定材质(如“哑光皮肤”)。

核心: 想要去油腻,必须用阴影塑造立体感。一旦你在图片阶段把光影和质感“死死钉住”,生成视频时就果断“做减法”——只写最微小的动作(如“轻微呼吸、打字”),AI自然会继承完美的光影。



速用卡

角色设计执行卡

把这节课压缩成一张可执行卡片:看重点、照步骤、避坑,再复制模板直接开做。

一句话重点

这节课不是让你照着参考图抄脸,而是围绕「赋予AI角色“活人感”的3个核心提示词法则」把原创角色脸拆成结构、比例、五官主次和妆造记忆点。

落地顺序

按原文节奏走最稳:先吃透「第一招:注重细节表达,用“微表情”与“潜动作”注入灵魂」,再把「第二招:打破“摆拍感”,用“环境对抗”让动作彻底活起来」定住,接着处理「第三招:精细化光影处理,用“局部光源”与“冷暖对比”拒绝油腻」;最后用「总结:赋予AI“活人感”的三大核心心法」收口。

照着做清单
  1. 把「第一招:注重细节表达,用“微表情”与“潜动作”注入灵魂」这一点先定准,再往下走。
  2. 把「第二招:打破“摆拍感”,用“环境对抗”让动作彻底活起来」这一点先定准,再往下走。
  3. 做完「第三招:精细化光影处理,用“局部光源”与“冷暖对比”拒绝油腻」后,先确认角色还是原创。
  4. 先把「总结:赋予AI“活人感”的三大核心心法」里说的脸型或气质定住。
  5. 围绕「反面案例:精致但空洞的“图库素材”」收一收五官,不要让每个部位都抢戏。
  6. 做完「引入身体语言的“潜台词”」后,先确认角色还是原创。
最容易踩坑

不要直接套真人脸或影视角色脸;不要把所有五官都做成强特征,否则容易撞脸、割裂、不稳定。

成品自检

检查角色是否有清晰记忆点;年龄感和气质是否一致;换妆造后脸是否稳定;是否不像任何明确真人或影视角色。

可直接复制的万能模板
请围绕「赋予AI角色“活人感”的3个核心提示词法则」帮我做一个可直接执行的方案。
我的目标是:【填写你的具体目标】
我的素材/产品/角色信息是:【填写已有素材和限制】

请输出:角色定位、脸型方向、三庭五眼比例、五官主次、妆造记忆点、完整生图提示词。要求原创、有辨识度、避免撞脸和网红脸。