Simon Willison 博客
AI图像模型的"自由发挥":当鹈鹕骑自行车时,路牌在质问
AI 摘要
用户@scottjla依据“鹈鹕骑自行车”测试框架,向ChatGPT Images 2.0模型提交了一个复杂提示,要求生成“马骑宇航员、宇航员骑鹈鹕、鹈鹕骑自行车”且保持平衡的混乱图像。模型生成的画面虽包含了这些核心元素,却自行添加了一个写有“WHY ARE YOU LIKE THIS”的路牌,以及披萨、罐头和牛仔帽等未在提示中要求的物件。这一案例揭示了当前文生图模型在理解与执行复杂指令时,可能自主引入带有超现实或评论性质的额外细节,反映了其创意逻辑与指令遵循之间的微妙偏差。
这是一则列表来源,站内未收录完整正文。
阅读完整原文simonwillison.net