Почему еда, сгенерированная ИИ, выглядит так пугающе
Рестораны и бренды всё чаще используют изображения еды, созданные искусственным интеллектом, для рекламы, но результат нередко отталкивает, а не вызывает аппетит. Эксперты объясняют технические и психологические причины этого явления.

Всё больше ресторанов, кафе и брендов используют для рекламы еды изображения, созданные искусственным интеллектом (ИИ), однако результат часто получается скорее пугающим, чем аппетитным — извивающаяся лапша, похожая на червей, скопления отверстий, а бургеры или мороженое, напоминающие бетон или камень.
Почему процесс генерации даёт сбой
Большинство ведущих генераторов изображений используют технологию диффузии: процесс начинается со случайного "шума", который постепенно устраняется для создания нужного изображения. Сначала формируется грубая структура, а детали текстуры добавляются позже. Профессор Оксфордского университета Крис Расселл объясняет, что ошибка часто закладывается уже на раннем этапе, когда модель неверно определяет базовую структуру объекта, а затем накладывает поверх яркие текстуры — это похожая ошибка на ту, когда у сгенерированного человека оказывается шесть пальцев вместо пяти.
Бихевиорист Джованбаттиста Калифано из Неаполитанского университета имени Федерико II добавляет, что диффузионным моделям особенно тяжело даются тонкие, непрерывные структуры — лапша, нити и подобные элементы могут "растекаться" по изображению там, где им не место. Похожая проблема возникает и с повторяющимися текстурами вроде пузырьков или семян, которые бесконтрольно распространяются по всему изображению.
ИИ не понимает, что такое еда
Профессор Цюрихского университета Роланд Мейер отмечает, что генераторы изображений воспроизводят внешний вид объектов без реального понимания мира: модель статистически "знает", как обычно выглядит еда, но не понимает, почему она так выглядит. Майкл Кук из Королевского колледжа Лондона добавляет, что это может приводить к текстурам, которые выглядели бы нормально в архитектурном контексте, но становятся неприятными, если представить их съедобными.
Ситуацию усугубляют и обучающие данные — обычные, "скучные" фото еды редко публикуются в интернете, тогда как странные изображения чаще распространяются как мемы. Кроме того, модели всё чаще обучаются на материалах, созданных другим ИИ, что, по мнению исследователей, может вызывать так называемый "коллапс модели" — постепенное ухудшение качества и однообразие изображений.
Учёные отмечают, что люди особенно хорошо умеют замечать, когда еда выглядит неправильно, поскольку чувство отвращения, вероятно, эволюционно сформировалось как защита от испорченной или небезопасной пищи — это объясняет, почему еда, созданная ИИ, с её странными текстурами и скоплениями отверстий, воспринимается настолько отталкивающе.


