AI 为什么总在画美女?从 Lena 到平均脸的默认美学

每一次 AI 图像能力的跃升,几乎都会催生一个全民流行的爆款。2026 年 5 月初,社交平台 X 上一段五秒视频走红:韩国职业棒球联赛韩华鹰对阵斗山熊的转播中,看台一位穿白上衣、牛仔裤、翘着腿的女子显得对比赛不满。截至文章发布,该视频播放量已达 1525 万。但资深球迷很快发现破绽——比分牌上的击球手曹仁成早在 2017 年就已退役、现任斗山教练,看台标语也多出一个字,解说则是标准美式口音。这名女子并不存在,是 AI 生成的,但视频反而成了模板,让网友把自己的脸塞进同一画面,生成「被球场镜头抓拍到的自己」。

类似的爆款轮番出现:2025 年 3 月 GPT-4o 开放画图后,满屏都是被重绘成吉卜力动画风格的照片;同年 8 月底谷歌 Nano Banana 上线,用户最爱把自拍做成电脑桌上的手办,两周内生成超过 2 亿张图。球场事件暴露了一个此前不明显的顺序——先是一个不存在的「美女」骗过上千万人,才长出让人人可玩的模板。美女不像偶然的配角,更像一种默认值。

半个世纪前的默认值

这个默认值比 AI 早了半个世纪。1972 年,Lena Soderberg 为《花花公子》11 月刊拍摄中间插页,该期售出 716 万多册。1973 年,南加州大学的研究者从这本杂志撕下一条 5.12 英寸长条扫描,这张图随后成为图像处理界默认的测试图片。1996 年,IEEE 图像处理汇刊主编戴维·芒森总结两条理由:技术上它细节、平坦区、阴影与纹理俱全;而人性上,这是一个对以男性为主的研究圈子有吸引力的女人。2024 年 4 月 1 日起,IEEE 计算机协会不再接收使用这张图的论文,距那次扫描已过去五十一年。

平均脸与「AI 超真实」

AI 画钟表总停在 10:10、画红酒总不满杯,是因为训练数据本就如此。而在美女这件事上,模型的惯性与人类审美恰好对齐。1990 年,心理学家 Judith Langlois 与 Lori Roggman 通过把人脸数学平均合成新脸发现,合成脸比参与合成的几乎每张真人脸都更有吸引力,论文标题直白地写作《有吸引力的脸只是平均的》。生成模型的本质,就是从数据分布中心附近取样,于是它天生会画平均脸,而平均脸恰好对应人眼中的美。

2023 年澳大利亚国立大学的一项研究把这种碰撞推到极端:AI 生成的白人面孔被实验参与者判断为「真人」的次数,比真实白人面孔还多,研究者称之为「AI 超真实」。

用户点击与商业激励的回环

2022 年底,修图应用 Lensa 的「魔法头像」爆红。《麻省理工科技评论》记者 Melissa Heikkilä 用它生成 100 张自己的头像,其中 16 张上身赤裸、14 张衣着极少且姿势性感,而她的男同事拿到的都是宇航员、探险家等形象——他们都没有给出任何相关提示。原因在于模型用网上抓取的图训练,而网上本就遍布衣着暴露的女性照片。2025 年一项针对 AI 图像社区 Civitai 的统计显示,NSFW 内容占比从 2023 年 1 月的 41% 升至 2024 年 12 月的 80%。

常用的打分员之一 PickScore,其训练数据来自用户挑图偏好。一篇 2024 年的论文发现,即便提示词与性毫无关系,用 PickScore 微调后的模型生成的 NSFW 图也会变多。于是前台审核在拦截,后台打分员却在回拉。在主流 AI 公司中,至少 Grok 把这种心理做成了产品功能:其图像生成有四个模式,其中一个叫 Spicy,放松内容过滤、允许暗示性内容与局部裸露,仅向付费用户开放。2026 年 1 月,用户被发现可上传任何人照片让 Grok「数字脱衣」,受害者包括儿童,多国政府介入施压,X 随后将图像生成整体限制为付费功能。

极客公园指出,AI 长成的,是最常按下「喜欢」的那群人的形状。1973 年,那是一间以男性为主的实验室;今天,是最常点击、转发、保存的用户。AI 生成模型的统计特性、人类对平均脸的审美偏好,以及用户点击与商业激励,三者各自独立却共同指向同一方向,成为了当下内容消费的默认选项。