Почему изображения еды, сгенерированные искусственным интеллектом, выглядят отвратительно
Рестораны и бренды все чаще используют искусственный интеллект для создания маркетинговых изображений еды, однако результат часто вызывает отторжение. Вместо аппетитных блюд пользователи видят слизистые комки, «лапшу» из дырок и текстуры, напоминающие строительные материалы. Эксперты объясняют этот феномен техническими ограничениями моделей диффузии и психологической эволюцией реакции человека на признаки опасности.

# Почему еда, созданная искусственным интеллектом, кажется несъедобной
Поток изображений еды, генерируемых искусственным интеллектом, становится все более токсичным. От кафе до крупных брендов переходят к использованию нейросетей для создания контента. Результатом становится «ужасающая шоу»: крендель-креветки, гамбургеры, состоящие из камней, паста, напоминающая червей, и десерты, которые визуально ассоциируются с человеческим мозгом. В то время как реальная еда стоит на полке и легко фотографируется, виртуальные аналоги часто выглядят так, будто их съела плесень или что их сформировали в бетонном замешке.
Эта проблема затрагивает не только эстетическое восприятие, но и основную задачу маркетинга — стимулировать аппетит. Искусственный интеллект пытается решить задачу, для которой у него нет врожденных знаний: он генерирует вид еды, но не понимает её физической сущности. В результате получается сюрреалистичный коллаж, который на подсознательном уровне сигнализировал бы о пище, содержащей паразитов.
Техническая неспособность генерировать сложные структуры
Корень проблемы лежит в самой архитектуре большинства современных генераторов изображений. Большинство из них используют модели диффузии (diffusion models). По словам Криса Расселла, профессора ИИ и политологии из Оксфорда, эти модели начинают с изображения чистого шума (статического) и постепенно убирают его, чтобы создать картину.
Этот процесс имеет фундаментальный недостаток. Сначала восстанавливаются грубые, крупные структуры, а тонкие детали и текстуры появляются только на финальном этапе. Часто базовая структура объекта формируется неверно, а затем на неё накладываются яркие, но нелепые текстуры. Это приводит к ошибкам, аналогичным тем, когда генерируемый человек имеет шесть пальцев.
Более того, модели имеют серьезные трудности с созданием тонких, непрерывных и заостренных форм. Как отмечает Джованбаттиста Калифано, поведенческий научник из университета Неаполя, «модели диффузии notoriously слабы в генерации тонких, непрерывных, завершающихся структур». Лапша, нити спагетти или тонкие веточки — это именно та геометрия, которая выводит систему из строя. Нейросеть не понимает, где объект должен заканчиваться, поэтому «лапша» начинает бить в области, где её быть не должно, создавая визуальный шум.
Простое объяснение: что такое диффузионные модели? > Представьте, что вы смотрите на экран телевизора, на котором только помехи (шум). Модель диффузии — это алгоритм, который очень медленно и осторожно пытается «очистить» этот шум, чтобы из него вырастала картинка. Если алгоритм ошибается на ранних стадиях, создав не ту форму основы, даже самая красивая текстура, наложенная сверху, не исправит ошибку формы. Результат будет выглядеть как глыба неправильного размера, покрытая шелком.
Отсутствие понимания физического мира
Даже если бы модель генерировала идеальную форму, у неё не было бы понимания того, что именно она рисует. У нейросети нет концепции хлеба, сыра или мяса. Она знает только статистическую вероятность: «обычно булочка круглая, а соус течет». Она не знает законов физики, которые диктуют, как ингредиенты должны взаимодействовать, держаться вместе или выглядеть под воздействием гравитации.
Роланд Мейер, профессор из Цюриха, объясняет, что ИИ воспроизводит лишь внешний облик фотографии, но не её профессиональную эстетику. Фотографы еды используют резкий контраст, блики и специфическое освещение для создания аппетита. ИИ копирует эти визуальные приемы, но не смысл. Он может создать текстуру, которая выглядит как треснувший бетон или камень, если в обучающей выборке такие образы ассоциировались с едой.
Майкл Кук, специалист по компьютерным наукам из колледжа Королевы в Лондоне, добавляет, что ИИ не понимает контекста. Текстура, которая выглядела бы нормально в архитектурном контексте, в контексте еды кажется ошибкой. Поскольку ИИ не знает, что еда не должна напоминать несъедобные материалы, он свободно комбинирует их, создавая образы, вызывающие оторопь.
Опасность «коллективного безумия» интернета и эволюция отчуждения
Еще один критический фактор — качество данных, на которых обучаются модели. Интернет пестрит странными изображениями: мемы, сюрреалистичное искусство и «мозговой туман» (brain rot). Поскольку популярные алгоритмы часто обучаются на материалах, созданных другими нейросетями, возникает феномен «краха модели» (model collapse). Это приводит к визуальной деградации и нарастающей схожести изображений, стирая различия и усиливая искажения.
Более того, у людей есть биологический механизм защиты от несъедобного. Как отмечает Калифано, отвращение эволюционно разработано для защиты от паразитов, патогенов и токсинов. Наш мозг запрограммирован замечать, когда что-то выглядит подозрительно.
Сгенерированные ИИ образы еды идеально попадают в так называемую «тропофобию» (боязнь скоплений дырок), которая ассоциируется с гнилью или насекомыми. Слизкие текстуры напоминают червей, а дырчатые поверхности — гнезда паразитов. Цвета и фактуры сигнализируют о порче. Таким образом, даже если мы знаем, что перед нами лишь пиксели, наш древний мозг кричит: «Это заражено, не трогай!»
Учитывая все это, изображения еды, созданные искусственным интеллектом, оказываются запертыми в «неловкой долине» (uncanny valley). Они настолько похожи на еду, чтобы вызвать надежду на вкус, но настолько неестественны, чтобы вызвать физическое отвращение. В мире, где реальная еда доступна для фотографирования, использование таких образов брендами может только вредить их репутации, превращая аппетитное блюдо в пугающее зрелище.
*Авторский штрих: Иногда кажется, что технологии развиваются быстрее нашего вкуса, но природа мудро помнит, что не всякая красивая поверхность безопасна для желудка.*