«Стандартное лицо», сгенерированное AI-видеомоделями, вторгается в ленты пользователей. Это изысканное, с белой кожей AI-лицо появляется в школьных драмах, исторических сериалах и даже в персонажах с изменённым полом, вызывая массовое недовольство пользователей. Тесты показали, что при использовании одинаковых запросов несколько основных видеомоделей генерируют одно и то же лицо — причина в том, что платформы по умолчанию включают усиление запросов, а сами обучающие данные моделей содержат эстетические предвзятости. Для обеспечения согласованности лиц между кадрами модели естественным образом предпочитают симметричные черты и стандартные контуры. Сочетание требований платформы, пользователей и модели привело к тому, что сгенерированный AI-контент оказался в ловушке эстетической однородности. Исследователи предупреждают, что это явление может усилить социальные стереотипы о внешности.Автор статьи, источник: Чапинь X.PIN
Нужны настоящие красивые девушки, чтобы порадовать глаз.
Все друзья, которые часто смотрят короткие сериалы и короткие видео, должны быть знакомы с этим лицом.
Те, кто не видел этого, могут подумать, что это какой-то новый интернет-инфлюенсер, но на самом деле это лицо, созданное ИИ, которое неоднократно появляется в различных видео.
Черты лица изящные, глаза достаточно большие, нос достаточно маленький, кожа всегда белоснежная, всегда с мягким фильтром, уголок губ идеально подобран.

Если бы реальный человек стоял перед ним, Ши Чжао, наверное, даже словом не обидел бы. Но именно это безобидное лицо подверглось жестокому онлайн-преследованию.
Не то чтобы она была некрасивой, а просто она, как будто представительница AI-сферы, которая пришла с деньгами и появляется во всем.
Она — белый месяц в кампусе, она — молодая леди из исторического драмы.
Это она — пяти- или шестилетняя девочка, и это она — пожилая женщина в возрасте семидесяти или восьмидесяти лет.
Еще раз внимательно посмотрел — вуаля, как это рядом с повязкой на голове дедушка — она??

Каждый день, открывая телефон, вы видите одно и то же лицо, и от просмотра коротких видео возникает ощущение страха, будто вас окружают псевдочеловеки.
А по мере того как всё больше людей об этом узнали, в сети раздаётся масса жалоб от пользователей:
Это лицо, я уже наелся им.
Теперь при виде этого лица возникает физическое отвращение.
Сколько человек испытывают отвращение, видя её?
Также некоторые задаются вопросом: почему все люди, сгенерированные ИИ, выглядят одинаково? Чье лицо он украл?
В комментариях кто-то предполагает, что это забаненная стримерша, кто-то говорит, что похожа на актера Ли Чуаня, а кто-то — на сестру Пак Чхан Ыля... Надо сказать, что и в Китае, и за рубежом, и мужчины, и женщины могут найти сходство.

Но проблема в том, что гадать напрасно — скорее всего, это не конкретное лицо, которое украли, а «среднестатистическое лицо», многократно сформированное на конвейере ИИ, которого на самом деле не существует.
Тогда откуда взялось это лицо?
Ши Чжао, не веря в суеверия, последовательно протестировал такие популярные видео-модели, как Seedance, KeLing, HaiLuo и HappyHorse, и в процессе экспериментов действительно обнаружил определённые закономерности.
Мы дали всем моделям два шанса с одним и тем же запросом «девушка на велосипеде»; по идее, каждый раз генерируемое лицо должно быть разным — иногда азиатское, иногда иностранное — именно такова природа крупных моделей.
Поскольку мы ограничились только полом и не дали никаких других подсказок, он должен случайным образом генерировать людей любой национальности, любого цвета кожи, любой прически, одежды и т.д. — совершенно разных людей.
На самом деле, при одинаковых подсказках почти все модели генерируют одинаковое лицо, одежду, обстановку и угол съемки.

Здесь, в Seedance 2.0 Fast, Ши Чжао снова нашел ту же самую ИИ-лицо, что и в начале — похоже, это и есть источник всех бед.
Если ошибается только одна модель, возможно, проблема в ней самой. Но если все модели одновременно теряют разнообразие... Ши Чжао провел исследование и обнаружил, что здесь, возможно, две причины.
На первом уровне, пользователи популярных видео-моделей должны знать, что видео-модели очень чувствительны к промптам. Иногда даже порядок одного слова или нескольких символов может повлиять на конечный результат генерации.
Чтобы обеспечить максимально стабильный вывод при каждом розыгрыше, наши подсказки часто подвергаются вторичной оптимизации на фоновом сервере.

Раньше «усиление промпта» было отдельной кнопкой, расположенной в стороне, и пользователи могли либо использовать улучшенный промпт, либо отправить исходный промпт без изменений. Однако Ши Чжао просмотрел множество платформ, и, кажется, сейчас это встречается редко — улучшение промпта стало функцией по умолчанию.
Например, если я ввожу «Девушка едет на велосипеде и смеется», то оптимизированный промпт, который фактически передается модели, может выглядеть так:
Молодая красивая азиатская девушка катается на велосипеде по солнечной аллее. У нее светлая кожа, изящные черты лица, большие глаза, маленький нос, длинные волосы естественно развеваются на ветру, она одета в белое платье и улыбается милой улыбкой. Кадр — средний план, мягкий естественный свет, малая глубина резкости, кинематографичная картинка, в стиле свежей и красивой эстетики, естественное выражение лица, плавные движения, высокое разрешение и реалистичность.
Смотреть один или два раза — это называется оптимизацией промптов, но если делать это тысячи раз, то это уже станет конвейером.
Таким образом, после того как Ши Чжао изменил промпт и добавил описание внешности, лицо в правом нижнем углу стало明显 другим. Однако без дополнительных указаний на окружающую среду девушка по-прежнему сидит на аллее с деревьями.

Однако красивые черты лица бывают разными, женщин так много в мире, почему ИИ распознает только эту?
Это приводит нас ко второй причине: изображения и видео-модели по своей природе обладают эстетическими предвзятостями.
В прошлом году в журнале «Nature» была опубликована статья, в которой прямо обсуждался этот вопрос. В ходе исследования было обнаружено, что если указать определённую расу, то генерируемые моделью лица выглядят как братья-близнецы.
Такое эстетическое искажение изначально возникает из данных: например, большинство людей предпочитают лица знаменитостей в соцсетях, и они естественным образом получают метку «красавица». Модель ничего не понимает — просто при дальнейших запросах «красавица» она будет стремиться к этому направлению.
В процессе обучения модель дополнительно усиливает этот смещение, в результате чего лица, генерируемые по одним и тем же ключевым словам-подсказкам, становятся все более похожими.

Кроме того, видео-модели могут дополнительно усугубить эстетическую стандартизацию из-за необходимости обеспечения согласованности во времени.
Ведь сгенерированные видео-моделями лица должны быть не только красивыми, но и стабильными, чтобы выглядеть как один и тот же человек на десятках и сотнях кадров спереди, сбоку и сзади.
Таким образом, модель также естественным образом предпочтет лица, которые легче сохранять в согласованности: симметричные черты, стандартные контуры, неэкстремальные черты, легко управляемые выражения и устойчивые повороты головы.
В итоге, платформе нравятся безопасные и красивые вещи, пользователям — короткие сериалы и интернет-звезда, модели — стабильные и стандартизированные решения; когда всё это складывается, рождается лицо, от которого всех тошнит.
Честно говоря, ему не нравятся почти все идеально сгенерированные ИИ красивые девушки, а не только недавно широко распространённая.

Источник: Xiao Hong Shu @Alexander
Появление ИИ-лиц в нашей ленте стало случайно организованным масштабным экспериментом по киберальienации.
Лицо, не имеющее реального прототипа, рожденное в результате очистки и конденсации бесчисленных данных о влиятельных лицах.
Когда они вытесняют наше время, проведенное за телефоном, и заменяют собой когда-то разнообразных реальных девушек, Ши Чжао чувствует себя крайне некомфортно, потому что наше восприятие мира и определение эстетики под давлением ИИ.
Таким образом, людям не нравятся AI-лица, во-первых, возможно, из-за эффекта «ужасающей долины», вызванного их нереалистичностью, но также из-за инстинктивного сопротивления однородности.
Некоторые говорят, что с течением времени AI-видео станет все более четким, детализированным и похожим на реальных людей, и когда люди перестанут различать реальное и поддельное, им это понравится.
Но Ши Чжао считает, что даже если технология сможет сделать ложное лицо неотличимым от настоящего, мы не сможем влюбиться в идеальную ложную физиономию без души.
Изображения, источники:
《Сгенерированные ИИ лица влияют на гендерные стереотипы и расовую гомогенизацию》N AlDahoul
Xiaohongshu, Douyin
