刷短剧总觉得 AI 脸怪怪的?明明脸很精致,为什么我们会觉得别扭?

数字北京科学中心    2026-07-21 21:12:07

近期,“对 AI 脸感到不适”相关话题接连冲上社交平台热搜。

打开短视频平台刷微短剧,连续刷几部后,主角个个是高颅顶、大眼窄鼻、冷白皮,精致得挑不出错,可表情僵硬空洞,看着看着心里一阵发毛,关掉手机却说不清到底哪里不对。

图源:社交媒体

这种说不清道不明的“不舒服”到底是什么?为什么会让人不适?

越像人越别扭的脸

这种“似人非人”的违和感,便是“恐怖谷理论”。1970 年,机器人学家森政弘提出:当仿生物体的拟人程度持续提升时,人类对其的好感度会同步上升;但当拟人度接近真人,却又在某些关键动态特征(如眼神变化、面部肌肉联动)上出现可被感知的偏差时,人类的好感会骤然下跌,产生疏离、排斥甚至不适的负面情绪。这个好感急剧下坠的区段,就是“恐怖谷”。 

当前微短剧中普遍使用的 AI 脸,很可能正处于恐怖谷的敏感区间。

现阶段,算法虽能拟合出符合大众审美的静态五官,却难以复现人类视觉系统高度敏感的生物运动信号——例如瞳孔的细微缩放、表情肌的协同收缩,以及光影随动作的自然流动。这些动态线索的缺失或失真,会直接触发大脑的知觉冲突反应。

当人的视觉系统捕捉到高度接近真人的脸,却同时识别出多处不符合真实人类生理特征的细节时,便会产生排斥、不适的情绪反应与回避倾向。

长得都一样的“完美脸"

真实人类的面容天然带有个体差异:肤色有自然色差,皮肤有纹理与小瑕疵,五官有独属于个人的特征。这些细节正是构成面容真实感的重要组成部分。

AI 生成模型训练数据多偏向端正、高吸引力的面容,加之制作方倾向于选取符合主流审美的生成结果,最终呈现的面孔很容易趋近一种“审美均值”,个体特征被大幅抹平。

在微短剧领域,大量 AI 制作批量套用通用模型,输出结果同质化严重,容易引发观众审美疲劳。当一张脸几乎找不到真实人类特有的细微瑕疵与独特印记时,它便不再像一个活生生的人,而更像一个经过算法平滑的视觉模型。

毫无感情的表演机器

微短剧大量采用近景和特写镜头,且单个镜头停留时间较长,这使得 AI 面孔的动态缺陷被充分暴露。若处于快速运动或远景中,同样的缺陷则不易被察觉。

除生理与审美层面的违和外,让观众产生排斥感的另一重要原因是难以引发情感共鸣。有感染力的表演,核心不只是面部表情的控制,更在于情绪的准确传递。

AI “演员”本质上是对表情符号的统计拟合,缺乏真实表情背后应有的自主神经生理反应(如心率变化、皮肤电反应)和情境性心理活动。它能合成“流泪”的面部动作,却无法传递真实悲伤所伴随的躯体节律与时间动态;能摆出“微笑”的嘴型,却没有真实喜悦中眼部肌肉的自然收缩与舒张节奏。这种“有形无神”的表演,让观众直观感受到情绪的空洞。

有这种不适感怎么办?

接纳不适感。对 AI 脸感到别扭不是矫情,是人类知觉识别机制的正常反应,不必怀疑自己的感受。

拒绝审美趋同。人类对面孔独特性的敏感具有进化心理学基础——面部差异帮助我们识别他人、判断意图与健康状态。不必被算法定义的“完美长相”裹挟,接纳真实的个体差异,本质上是回归人类正常的社会认知本能。

多关注“活人感”视频。真正打动人心的内容,往往不只是靠无瑕疵的精致,带有真实细节的角色往往更有生命力。

屏幕里的 AI 脸可以做到极高的精致度,却承载不了生命的温度与情绪的重量。你对真实感的偏好,是人类知觉系统形成的重要倾向,也是极具价值的感知能力。

数字北京科学中心)

责任编辑:韩爽