TechCrunch · AI · 2 ч назад

Проблема сходства, лежащая в основе неаппетитных меню, созданных ИИ

В то время как владельцы ресторанов могут рассматривать генеративный искусственный интеллект как способ улучшить свое меню, клиенты могут интуитивно чувствовать, что с едой что-то не так.

Источник TechCrunch
Опубликовано 2 ч назад
Оригинальный заголовок The sameness problem behind those unappetizing AI-generated menus
Важность 4/5
Почему это может быть интересно Важно для понимания, куда реально двигаются модели, агенты и продуктовые AI-инструменты.
← Назад к ленте Открыть оригинал
#ai#startups#tech

Подробности

Когда это впервые случается с тобой, ты думаешь, что ты сумасшедший. Вы заходите в кафе и смотрите на меню с разнообразными сэндвичами с бубликами, но каждая иллюстрация выглядит устрашающе безупречно, точно симметрично и странно гладко, вызывая интуитивное ощущение, что что-то не так. Вы можете думать, что у вас паранойя, но вы не теряете рассудок. Генеративные меню с искусственным интеллектом проникли в ресторанный бизнес благодаря моделям, обученным узкой, «приятной» эстетике, которая кажется неправильной, даже если вы не можете сформулировать, почему.

Иногда эти иллюстрации оказываются вопиюще фальшивыми, как буррито с сыром, настолько игристым и плавящимся, что это больше похоже на авангардное искусство, чем на обед. Чаще всего они выглядят настолько обычными, что замечаешь, что что-то не так, только когда присмотришься на секунду.

«Это почти как инопланетянин, пытающийся приготовить пиццу, не понимая ее основных принципов», — сказал TechCrunch технический директор Reality Defender Алекс Лайл. (Reality Defender сам по себе является частью растущей категории стартапов, продающих инструменты AI-обнаружения и проверки контента — бизнес, который существует отчасти из-за проблем, подобных этой.)

Лайл говорит, что способ построения этих моделей может помочь объяснить, почему иллюстрации, кажется, охватывают такую ​​специфическую эстетику — где каждая ложка мороженого идеально круглая, а креветки, кажется, были генетически модифицированы, чтобы есть свои собственные хвосты, создавая новые «лавкрафтовские кулинарные ужасы».

Большие языковые модели (LLM) и диффузионные модели — виды моделей ИИ, которые делают возможными, казалось бы, всеведущие чат-боты и генераторы изображений, такие как ChatGPT и Midjourney, — обучаются на огромных объемах данных. Затем модели выявляют закономерности в наборах данных, чтобы предсказать, что ищет пользователь, когда спрашивает что-то вроде: «Сделай мне меню для бургерного ресторана».