Аи, почему ты всегда рисуешь красивых женщин?

📅 2026-10-05

Аннотация:

В начале мая этого года пятисекундное видео X стало вирусным. Это трансляция Корейской профессиональной бейсбольной лиги, где «Ханва Иглз» играют против «Дусан Беарс». Камера показала женщину на трибунах в белом топе и джинсах, скрестившую ноги. В какой-то момент она, казалось, вздохнула и отвела взгляд, выглядя недовольной игрой.


Подпись к видео: «Обычные кореянки». На момент публикации этой статьи видео было просмотрено 15,25 миллиона раз|Источник видео: X @kangminlee

Но вскоре группа пожилых фанатов заметила, что что-то не так. На табло было указано, что отбивающим был Чо Инсон, но Чо Инсон ушел из спорта в 2017 году и сейчас работает тренером в «Дусан».

Кроме того, в аплодисментах на трибунах на одно слово больше, чем в официальном слогане Doosan Bears, который, похоже, является прямым и буквальным переводом ИИ. Что касается этой передачи, то комментарий был со стандартным американским акцентом, что тоже было очень подозрительно.

Этой женщины не существует, ее создал ИИ. Но видео не исчезло после того, как было опубликовано. Вместо этого оно стало шаблоном. Все поместили свои лица на один и тот же экран трансляции, создав свою фотографию, снятую камерой стадиона, которая быстро стала популярной в социальных сетях.


Шаблон «Я заснят камерой стадиона» быстро стал популярным шаблоном|Источник фото: RADII

Каждый раз, когда возможности изображений ИИ расширяются, почти всегда появляется популярный хит. Например, в марте 2025 года GPT-4o умел рисовать картинки, а экран был заполнен фотографиями, перерисованными в стиле анимации Ghibli; в конце августа был запущен Nano Banana от Google. Любимым способом игры было превращение селфи в фигурки, которые ставили на компьютерный стол. Пользователи сгенерировали более 200 миллионов изображений за две недели.

Популярные предметы каждый раз меняются, и большинство из них основаны на игровом процессе «погрузитесь в себя». Но на этот раз на площадке обнажилась не столь очевидная до этого последовательность: сначала несуществующая красавица обманула десятки миллионов людей, а затем разработала шаблон, по которому может сыграть каждый.

Красота — это не второстепенная роль, случайно появляющаяся в сцене, она скорее значение по умолчанию.

.

Это значение по умолчанию предшествует ИИ на полвека. В 1973 году, на заре оцифровки изображений, группа инженеров захотела протестировать новую технологию изображения и также выбрала красивую женщину.

01

Первая леди Интернета

Лена Содерберг начала свою карьеру в качестве фотомодели в Чикаго, штат Иллинойс. Ранее она переехала в США из Швеции в качестве помощницы по хозяйству. В 1972 году она позировала для разворота ноябрьского номера журнала Playboy. Этот выпуск Playboy был продан тиражом более 7,16 миллиона экземпляров, что сделало его самым продаваемым выпуском журнала.

Большинство людей, изучавших цифровую обработку изображений, видели ее: в широкополой шляпе, с обнаженными плечами и искоса смотрящей в камеру. На протяжении десятилетий на этом лице было протестировано бесчисленное количество алгоритмов сжатия и обработки изображений.


Лена Содерберг – первая леди киберпространства | Источник изображения: БАЗА ДАННЫХ ИЗОБРАЖЕНИЙ SIPI

В 1973 году исследователи из Института изображения и обработки сигналов Университета Южной Калифорнии пытались найти новое изображение для исследовательской работы. Они исчерпали свой обычный запас тестовых изображений. Сообщается, что в этот момент вошел коллега с ноябрьским номером Playboy за 1972 год. Видя затруднительное положение исследователей, он оторвал 5,12-дюймовую полоску от верхней части центральной вставки и вставил ее в сканер.

С тех пор

это изображение широко использовалось в сообществе специалистов по обработке изображений и даже стало тестовым изображением по умолчанию в отрасли

.

В 1996 году Дэвид Мансон, главный редактор журнала IEEE Transactions on Image Processing, написал короткую статью, в которой объяснил, как случайно отсканированное изображение стало отраслевым стандартом. Он назвал две причины. Первый – технический. В этой картинке есть все детали, плоские участки, тени и текстуры, поэтому она подходит для тестирования алгоритмов. Вторая статья больше соответствует человеческой природе:

Это фотография привлекательной женщины. Неудивительно, что к этому привлекает исследовательский круг, в котором преобладают мужчины

.

Учитывая происхождение этого изображения, его использование не обошлось без противоречий. В 1991 году Playboy обнаружил изображение на обложке академического журнала, отправил письмо с заявлением об авторских правах и в конечном итоге отказался от него, позволив и дальше использовать его в исследованиях. Вице-президент компании по новым медиа заявил, что раз это стало явлением, то лучше этим воспользоваться.

В исследовательском сообществе по обработке изображений также раздаются разные мнения. Они отметили, что инженерам не следует использовать материалы из любых публикаций, которые могут быть сочтены унизительными для женщин.

Даже сама Лена в документальном фильме «Теряя Лену» заявила, что надеется перестать использовать эту картинку.


В документальном фильме Лена сама держит свою знаменитую фотографию, сделанную более 50 лет назад | Источник изображения: IMDB

В результате с 1 апреля 2024 года Компьютерное общество IEEE больше не будет принимать статьи, использующие это изображение.

С момента этого сканирования прошел пятьдесят один год

.

02

Обычное лицо

Сейчас тестовые вопросы в техническом кружке давно изменились.

ИИ не может налить полный стакан красного вина. Уровень жидкости в стакане всегда останавливается посередине. Когда ИИ рисует часы, стрелки всегда останавливаются на отметке 10:10. Причина та же: большинство фотографий красного вина в Интернете — это не полные бокалы, а в рекламе часов принято показывать их в 10:10. Модель будет повторять распределение обучающих данных и не сможет избавиться от инерции данных.


Самое популярное объяснение того, почему реклама на часах всегда останавливается в 10:10, заключается в том, что это выглядит как «веселая улыбка», но до 1950-х годов было более популярно останавливаться в 8:20 | Источник изображения: Reddit

Красное вино и часы — свидетельство того, что «модели недостаточно хороши». Но когда дело касается красивых женщин, ситуация иная. «Ее» инерция совпадает с эстетикой людей.

В 1990 году психологи Джудит Ланглуа и Лори Роггман провели эксперимент: они математически усреднили группу лиц, чтобы синтезировать новое лицо, а затем попросили людей оценить его. В результате синтетическое лицо более привлекательно, чем почти все реальные лица, участвующие в синтезе, и чем больше лиц участвует в среднем, тем лучше выглядит синтетическое лицо. Этот эффект справедлив как для мужских, так и для женских лиц, а также для представителей разных этнических групп.

Название статьи называется просто

"Привлекательные лица бывают только средними"

.

Подобные наблюдения имели место и ранее. В 1877 году кто-то написал Дарвину и сообщил ему, что если совместить два портрета женщины с помощью стереоскопа, то лицо будет с каждым разом значительно красивее.

Суть генеративной модели на самом деле состоит в том, чтобы изучить распределение данных, а затем выполнить выборку из центра распределения. Другими словами, модель запрограммирована на рисование обычных лиц, а средние лица — это то, что люди считают красивыми.

Психология человека в сочетании с машинными принципами стала технической основой красоты как ценности ИИ по умолчанию.

.

Исследование Австралийского национального университета 2023 года довело это столкновение до крайности. Психологи обнаружили, что белые лица, сгенерированные ИИ, воспринимались участниками эксперимента как «настоящие» чаще, чем настоящие белые лица. Исследователи называют это «гиперреализмом ИИ», объясняя, что данные обучения в основном представляют собой белых людей, а лица, сгенерированные моделью, ближе к среднему значению этой группы и будут восприниматься как более типичные и больше похожие на реальных людей.

После публикации эксперимента Ланглуа он подвергся критике: Синтетическое лицо выглядит хорошо только потому, что пятна и огрехи на коже легко стираются при усреднении. Эта критика носила методологический характер в 1990 году.

Но сегодня это выглядит как пророчество.

Самая типичная черта ИИ-красавиц — чрезмерно гладкая кожа. Спустя более трех десятилетий организации по проверке фактов учат людей распознавать изображения ИИ, и одним из перечисленных недостатков является чрезмерно гладкая кожа. Тот статистический артефакт, на который указывали критики более трёх десятилетий назад, характеризует красоты ИИ 2025 года.

03

Гипсовое яйцо

Лена была отобрана в лаборатории. Сегодняшнее значение по умолчанию выведено из данных.

В конце 2022 года внезапно стала популярной функция «Волшебный аватар» приложения для редактирования фотографий Lensa: загрузите несколько селфи, и ИИ сгенерирует для вас сотню портретов в разных стилях. Мелисса Хейккиля, репортер по искусственному интеллекту в MIT Technology Review, также использовала его для создания 100 своих аватаров, 16 из которых были топлесс и 14 с минимальным количеством одежды и сексуальными позами. И все ее коллеги-мужчины стали космонавтами, исследователями и изобретателями. Никто из них не дал модели никаких намеков во время этого процесса.


Изображение создано Мелиссой через Lensa|Источник изображения: MIT TECHNOLOGE REVIEW

Мелисса объяснила в своей статье, что модель, стоящая за ней, тренировалась на фотографиях, взятых из Интернета, а

Интернет уже полон фотографий полураздетых женщин. Это приводит к тому, что модель генерирует «полураздетых женщин» в качестве значения по умолчанию.

.

Тогда поведенческая инерция пользователей продолжит стимулировать эту тенденцию. Каждое поколение, сохранение и пересылка — это голосование. Исследование 2025 года подсчитало изменения в контенте сообщества изображений AI Civitai: доля изображений NSFW (ориентированных на взрослых) выросла с 41% в январе 2023 года до 80% в декабре 2024 года.

Наконец, производитель запишет эти голоса в модель. Чтобы модель изображения могла генерировать более приятные изображения, производители обучают «оценщика», который технически называется моделью вознаграждения или эстетическим бомбардиром. Его задача — узнать, какие изображения люди считают красивыми, а затем использовать этот стандарт для обучения модели: больше двигаться в направлении с высоким баллом и меньше — в направлении с низким баллом.

Один из наиболее часто используемых скореров называется PickScore. Данные для ее обучения поступают из веб-приложения: пользователь пишет слово-подсказку, система выдает две картинки, и пользователь выбирает ту, которая ему больше нравится.

Эти данные будут проверены, а пользователи, создающие контент NSFW, будут исключены, но в них по-прежнему смешано много слов-подсказок NSFW. В статье 2024 года, посвященной изучению моделей вознаграждения, было обнаружено, что использование PickScore для точной настройки модели

даже если слова-подсказки не имеют ничего общего с полом, модель будет рисовать больше изображений NSFW

.

Затем появляется картина: рецензент контента на стойке регистрации перехватывает, но секретарь на бэкэнде отступает. В официальных демо-версиях производителя никогда не фигурируют красавицы NSFW, а политика генерации очень строгая. Но, как мы все знаем, сегодняшние большие модели не полностью управляемы. Он был обучен вкусу пользователя, а вкус пользователя по инерции зашел очень далеко.

В 1930-х годах голландский этолог Нико Тинберген наблюдал вид чаек. Эта птица откладывает маленькие бледно-голубые с серыми пятнами яйца. Но когда он клал рядом с гнездом огромные ярко-синие гипсовые яйца с черными точками, птицы бросали свои собственные яйца и забирались на гипсовые яйца, чтобы их высиживать. Он назвал эти преувеличенные имитации, которые более привлекательны, чем настоящие, «сверхнормальной стимуляцией».


Нико Тинберген красит яйца во время экспедиции на открытом воздухе | научные круги

Человеческое лицо также обладает необыкновенной стимуляцией, что расширяет концепцию «среднее — самое красивое». В 1994 году Дэвид Перретт и другие опубликовали исследование в журнале Nature: группа самых красивых лиц была синтезирована и оказалась более симпатичной, чем среднестатистическое лицо всех людей; а если бы разница между ним и средним лицом была увеличена на 50%, оценка была бы еще выше. Японцы и белые подданные выбрали одно и то же направление.

Среди основных компаний, занимающихся искусственным интеллектом, по крайней мере одна напрямую превратила эту психологию в особенность продукта. Генерация изображений Грока имеет четыре режима, один из которых называется Spicy. При включении фильтрация контента будет ослаблена, позволяя создавать непристойный контент и частичную наготу, и доступна только платящим пользователям.

В январе 2026 года пользователи обнаружили, что могут загружать фотографии кого угодно, чтобы «раздеть» Грока в цифровом виде. Среди жертв были дети, и многие правительства вмешались, чтобы оказать давление. В ответ X ограничил создание изображений в целом платной функцией.

Пресс-секретарь британского премьер-министра прокомментировал: «Это всего лишь функция создания незаконных изображений, превращенная в платную услугу».

ИИ вырастает в форму группы людей, которые чаще всего нажимают «Нравится».

. В 1973 году эта группа состояла преимущественно из мужчин-лаборантов. Сегодня именно они являются пользователями, которые больше всего кликают, больше всего пересылают и больше всего сохраняют. Предпочтение людей к красоте имеет биологическую основу. Младенцы в возрасте двух и трех месяцев будут дольше смотреть на лица, которые взрослые считают привлекательными.

Лена, первая леди Интернета, стала несчастным случаем. Сегодня по умолчанию модель растет из центра данных. Клики пользователей продвигали его все дальше и дальше, и наконец кто-то назначил за него цену.

Статистические характеристики модели генерации ИИ, эстетические предпочтения человека к «среднему лицу», а также клики пользователей и коммерческие стимулы образуют петлю обратной связи. Они независимы друг от друга, но вместе они указывают в одном направлении, становясь сегодня нашим стандартным вариантом потребления контента.

Связанные теги

Похожие статьи

Комментарии

0/500
Captcha (click to refresh)
Нет комментариев