Obrazy AI w menu restauracji mogą wywoływać dyskomfort u gości — TechCrunch
Generatywna sztuczna inteligencja jest wykorzystywana do projektowania menu restauracyjnych, jednak wygenerowane obrazy jedzenia mogą wydawać się gościom nienaturalne i wywoływać dyskomfort. Jak informuje TechCrunch, takie ilustracje często wyróżniają się nadmierną symetrią, gładkością i idealnymi kształtami produktów.
Dyrektor technologiczny firmy Reality Defender, Alex Lyle, wyjaśnił, że generatory obrazów odtwarzają utrwalone wzorce wizualne, lecz nie zawsze uwzględniają podstawowe zasady wyglądu potraw. W rezultacie na obrazkach mogą pojawiać się nienaturalnie okrągłe kulki lodów lub krewetki ze zdeformowanymi ogonami.
Dlaczego obrazy stają się jednolite
Duże modele językowe i dyfuzyjne, które stanowią podstawę chatbotów oraz generatorów obrazów takich jak ChatGPT i Midjourney, uczą się na ogromnych zbiorach danych i wykrywają w nich prawidłowości. Jeśli model zostanie poproszony o stworzenie menu dla lokalu szybkiej obsługi, może wzorować się na stylach popularnych sieci, w tym Wendy’s, Burger King lub McDonald’s.
Menu i reklamy żywności już wykorzystują podobną estetykę, przedstawiając dania w możliwie najbardziej atrakcyjny sposób. Lyle zaznaczył, że ze względu na dane treningowe wiele takich rezultatów przypomina menu sieci Chili’s z 2015 roku. Według Lee Rainie, dyrektora Centrum Imagining the Digital Future na Uniwersytecie Elona, optymalizacja modeli pod kątem „przyjemnego” i nieobraźliwego wyniku może sprzyjać wizualnej jednolitości.
Więcej aktualnych wiadomości na kanale UA.News w Telegramie Telegram.
Skutki wielokrotnych poprawek
Użytkownik X o pseudonimie Labtec pokazał eksperyment, w którym menu stworzone w ChatGPT edytowano 100 razy. Po licznych poprawkach obrazy jedzenia coraz mniej przypominały prawdziwe potrawy; TechCrunch poinformował, że powtórzył badanie i uzyskał podobny wynik.
Lyle nazwał takie pogorszenie konwergencją: obniża ona jakość rezultatów, lecz nie jest tożsama z zapadaniem się modelu. Do zapadania się może dojść, gdy modele są trenowane na nadmiernej ilości własnych wygenerowanych treści. W menu wielokrotne zmiany drobnych szczegółów, na przykład cen lub nazw pozycji, mogą stopniowo sprawiać, że ilustracje stają się gładsze i bardziej zaokrąglone.
Naukowcy z Uniwersytetu Duisburg-Essen w Niemczech stwierdzili w przypadku wygenerowanych przez AI obrazów jedzenia efekt „doliny niesamowitości”: obrazki, które niemal wyglądały jak prawdziwe, wywoływały więcej obrzydzenia i niepokoju niż te wyraźnie sztuczne. Rainie zauważył również, że ludzie często intuicyjnie dostrzegają różnicę między prawdziwym obrazem a wynikiem pracy AI, nawet jeśli nie potrafią jej jasno wyjaśnić.
Czytaj nas na Telegram i Sends