餐厅菜单中的AI图像或令顾客感到不适——TechCrunch
生成式人工智能正被用于设计餐厅菜单,但生成的食物图像可能让顾客觉得不自然并引发不适。TechCrunch报道称,这类插图往往具有过度的对称性、平滑感以及食物的完美形状。
Reality Defender首席技术官亚历克斯·莱尔解释说,图像生成器会复现既有的视觉模式,但并不总是考虑菜肴外观的基本原则。因此,图中可能会出现不自然地圆的冰淇淋球,或尾部变形的虾。
图像为何变得千篇一律
作为ChatGPT和Midjourney等聊天机器人及图像生成器基础的大型语言模型和扩散模型,会在海量数据集上训练并从中识别规律。如果要求模型为一家快餐店制作菜单,它可能会参考包括Wendy’s、Burger King或McDonald’s在内的知名连锁品牌风格。
菜单和食品广告已经采用类似的美学风格,以尽可能吸引人的方式展示菜品。莱尔指出,由于训练数据,许多此类结果让人联想到2015年的Chili’s连锁餐厅菜单。埃隆大学Imagining the Digital Future中心主任李·雷尼表示,将模型优化为产生“愉悦”且不冒犯人的结果,可能会助长视觉上的同质化。
更多最新消息请关注 UA.News Telegram 频道 Telegram.
反复修改的后果
X平台上一名化名Labtec的用户展示了一项实验:由ChatGPT创建的菜单被编辑了100次。经过多次修改后,食物图像越来越不像真实菜肴;TechCrunch称其重复了这项研究,并得到了类似结果。
莱尔将这种恶化称为收敛:它会降低结果质量,但并不等同于模型崩溃。当模型在过多自身生成的内容上训练时,可能会发生崩溃。在菜单中,反复修改价格或菜品名称等小细节,可能会逐渐使插图变得更加平滑和圆润。
德国杜伊斯堡-埃森大学的研究人员发现,AI生成的食物图像存在“恐怖谷”效应:那些看起来几乎真实的图片,比明显人工生成的图片更容易引发厌恶和不安。雷尼还指出,人们常常能凭直觉注意到真实图像与AI生成结果之间的差异,即使他们无法清楚解释这种差异。