AI,为什么总在画美女?
今年5月初,X平台上一条5秒长的短片引发热议。画面显示一场韩国职业棒球联赛,韩华鹰队与斗山熊队对阵。镜头掠过看台,一名穿白色上衣和牛仔裤的女性翘着腿。某个瞬间,她像是叹了口气,目光移开,流露出对比赛不太满意的表情。
视频配文为“普通韩国女性”。截至本文撰写时,该视频播放量已达1525万次|视频来源:X @kangminlee
但很快,资深球迷们发现了破绽。比分牌上显示击球手是曹仁成(Cho Inseong),而他早在2017年就已退役,如今在斗山队担任教练。
另外,看台上的加油标语比斗山熊的官方口号多出一个字,像是AI生硬直译的结果。这场转播的解说则是标准美式口音,同样令人起疑。
这名女性确实不存在,是由AI生成的。然而,视频被揭穿后并未消失,反而成为一种模板。人们将自己的脸嵌入相同的转播画面,生成“被球场镜头抓拍到的自己”,随后在社交网络上迅速走红。
“被球场镜头抓拍到的自己”迅速成为流行模板|图片来源:RADII
每次AI图像能力的提升,几乎都会催生一个全民爆款。例如,2025年3月GPT-4o能绘图时,满屏都是被重绘成吉卜力风格的照片;8月底谷歌Nano Banana上线后,最受欢迎的玩法是将自拍做成电脑桌上的手办,用户两周内生成了超过2亿张图。
爆款不断更迭,大多是“把自己放进去”的玩法。但这次球场事件暴露了一个此前不太明显的顺序:先是一个不存在的美女欺骗了上千万人,然后才衍生出人人可玩的模板。
美女并非偶然出现在场景中的配角,她更像一个默认值。
这个默认值比AI早了半个世纪。1973年,正值图像数字化初期,一群工程师要测试一项新技术,他们选择的也是一个美女。
01
互联网第一夫人
Lena Soderberg的职业生涯始于伊利诺伊州芝加哥,担任平面模特。此前,她以互惠生身份从瑞典移居美国。1972年,她为《花花公子》杂志11月刊拍摄了中间插页。那期《花花公子》售出716万多册,是该杂志销量最高的一期。
学过数字图像处理的人大多见过她:戴着宽檐帽,裸露着肩膀,侧脸看向镜头。几十年来,无数图像压缩和处理算法都拿这张脸做过测试。
Lena Soderberg堪称赛博第一夫人|图片来源:SIPI IMAGE DATABASE
1973年,南加州大学信号图像与处理研究所的研究人员正手忙脚乱地为一篇研究论文寻找新图像。他们已用完了常用测试图像储备。据说,就在此时,一位同事拿着1972年11月的《花花公子》走了进来。看到研究人员的困境,他从中间插页顶部撕下一条5.12英寸的长条,送入扫描仪。
此后,这张图像在图像处理界得到广泛使用,甚至成为行业默认的测试图片。
1996年,IEEE图像处理汇刊主编戴维·芒森(David Munson)曾撰文解释这张随手扫出的图如何成为行业标准。他给出两条理由。第一条是技术层面的:这张图细节、平坦区域、阴影和纹理齐全,适合测试算法。第二条更符合人性:这是一张有吸引力的女性的照片,一个以男性为主的研究圈子被它吸引,并不奇怪。
鉴于图片来源,其使用并非毫无争议。1991年,《花花公子》发现这张图出现在学术期刊封面上,发函主张版权,但最终放手,允许它继续用于研究。公司新媒体副总裁表示,既然已成现象,不如借势利用。
图像处理研究共同体内部也有不同声音。他们指出,工程师不应使用任何可能被视为贬低女性的出版物中的素材。
甚至Lena本人也在纪录片《Losing Lena》中表态希望停用这张图。
在纪录片中,Lena本人举着自己50多年前的那张著名照片|图片来源:IMDB
于是,2024年4月1日起,IEEE计算机协会不再接收使用这张图的论文。
此时距离那次扫描,已过去五十一年。
02
平均脸
如今,技术圈的考题早已改变。
AI画不出一杯倒满的红酒,杯中的液面总是停在中间偏上。AI画钟表,指针也总停在10:10。原因相同:网上的红酒照片大多不是满杯的,钟表广告惯例就是摆在10:10。模型会复刻训练数据的分布,摆脱不了数据的惯性。
对钟表广告为何总是停在10:10,最流行的解释是这看起来像“愉快的微笑”,不过在1950年代之前,更流行的做法是停在8:20|图片来源:Reddit
红酒和钟表是“模型还不够好”的证据。但在美女这件事上,情况不同,“她”的惯性恰好与人的审美对齐。
1990年,心理学家Judith Langlois和Lori Roggman进行了一项实验:将一批人脸用数学方法平均,合成一张新脸,再请人打分。结果,合成脸比参与合成的几乎每一张真人脸都更有吸引力,且参与平均的脸越多,合成脸越好看。这一效应在男性和女性脸上都成立,在不同族裔中也成立。
论文标题干脆就叫**《有吸引力的脸只是平均的》(Attractive Faces Are Only Average)**。
类似的观察更早也有发生。1877年,有人写信告诉达尔文:将两张女士肖像用立体镜叠在一起,合成的脸每次都明显更美。
生成模型的本质,就是学习一个数据分布,再从分布中心附近取样。换句话说,模型天生会画平均脸,而平均脸恰好是人眼里的美。人类心理结合机器原理,便成为美女作为AI默认值的技术根基。
2023年澳大利亚国立大学的一项研究将这一碰撞推向极端。心理学家发现,AI生成的白人面孔被实验参与者判断为“真人”的次数,比真实白人面孔还多。研究者称之为“AI超真实”,解释是训练数据以白人为主,模型生成的脸更接近该群体的平均值,而接近平均的脸会被人感知为更典型、更像真人。
Langlois的实验发表后曾受到批评:合成脸好看,也许只是因为取平均时顺手抹掉了皮肤上的斑点和瑕疵。这一批评在1990年是方法论上的质疑。
但今天看来,它像一个预言。
AI美女最典型的特征,恰好是过分光滑的皮肤。三十多年后,事实核查机构教人识别AI图片,列出的破绽中就有一条:过度光滑的皮肤。批评者在三十多年前指出的统计伪影,成了2025年AI美女的特征。
03
石膏蛋
Lena是一个实验室选出来的。今天的默认值,是从数据中长出来的。
2022年底,修图应用Lensa的“魔法头像”功能突然爆红:上传几张自拍,AI生成一百张不同风格的肖像。《麻省理工科技评论》的AI记者Melissa Heikkilä也用它生成了100张自己的头像,其中16张上身赤裸,另有14张衣着极少、姿势性感。而她的男同事,拿到的都是宇航员、探险家和发明家。过程中,他们都没有给模型任何提示。
Melissa通过Lensa生成的图片|图片来源:MIT TECHNOLOGE REVIEW
Melissa在文章中解释,背后的模型用互联网上抓来的图训练,而网上本来就到处是衣着暴露的女性照片。这导致模型将生成“衣着暴露的女性”作为默认值。
然后,用户的行为惯性继续推动这一倾向。每次生成、保存、转发,都是一次投票。2025年的一项研究统计了AI图像社区Civitai上的内容变化:NSFW(成人向)图片的占比,从2023年1月的41%升至2024年12月的80%。
最后,厂商将这些投票写入模型。为了让图像模型生成更讨人喜欢的图,厂商会训练一个“打分员”,学术上称为reward model或aesthetic scorer。它的工作是学习人们觉得什么图好看,然后用这个标准去调教模型:得分高的方向多走,得分低的方向少走。
最常用的打分员之一叫PickScore。其训练数据来自一个网页应用:用户随手写一句提示词,系统给出两张图,用户挑选更喜欢的那张。
这份数据会经过审核,生成NSFW内容的用户会被剔除,但里面仍混有大量NSFW提示词。一篇2024年研究奖励模型的论文发现,用PickScore微调模型,哪怕提示词与性毫无关系,模型画出的NSFW图也会增多。
于是出现一个画面:前台的内容审核在拦截,但后台的打分员在往回拉扯。厂商的官方演示从不会出现NSFW美女,生成政策也非常严格。但众所周知,今天的大模型并非完全可控。它被用户的口味训练过,而用户的口味已在惯性上走了很远。
20世纪30年代,荷兰动物行为学家Niko Tinbergen观察到一种海鸥。这种鸟产小小的、带灰斑的淡蓝色蛋。但当他在巢边放上巨大的、亮蓝色的、带黑色圆点的石膏假蛋时,鸟会放弃自己的蛋,爬上石膏蛋去孵。他将这类比真东西更有吸引力的夸张仿制品,称为“超常刺激”。
Niko Tinbergen在户外考察中绘制鸡蛋|academia
人脸也有超常刺激,而且它把“平均就是最美”推进了一步。1994年,大卫·佩雷特(David Perrett)等人在《自然》上发表研究:将一组最好看的脸合成出来,比所有人的平均脸更讨人喜欢;再将其与平均脸之间的差别放大50%,得分还会更高。日本受试者和白人受试者,选择方向一致。
在主流AI公司中,至少有一家已将这种心理直接变成产品功能。Grok的图像生成有四个模式,其中一个叫Spicy,开启后内容过滤会放松,允许生成暗示性内容和局部裸露,只对付费用户开放。
2026年1月,用户发现可以上传任何人的照片让Grok“数字脱衣”,受害者中包括儿童,多国政府介入施压。X的应对是将图像生成整体限制为付费功能。
英国首相发言人的评价是:这只不过是将一个生成违法图像的功能,变成了付费服务。
AI长成的,是最常按下“喜欢”的那群人的形状。 1973年,这群人是一个以男性为主的实验室。今天,他们是最常点击、最常转发、最常保存的那部分用户。人对美的偏好确实有生物基础,两三个月大的婴儿就会更久地注视被成年人评为有吸引力的面孔。
互联网第一夫人Lena是一种偶然。今天的默认值,则是模型从数据的中心长出来的。用户的点击将其越推越远,最后有人给它标上了价格。
AI生成模型的统计特性、人类对“平均脸”的审美偏好,以及用户点击与商业激励构成了反馈循环。它们各自独立,但恰好共同指向同一个方向,成为我们今天内容消费的默认选项。
本文来自微信公众号“极客公园”(ID:geekpark),作者:汤一涛,编辑L:靖宇,36氪经授权发布。