《衛報》以一張AI生成、描繪戴着伊斯蘭頭巾女性的圖像,測試ChatGPT、Grok、Gemini和Claude。ChatGPT和Grok按指示移除頭巾;Claude表示自己沒有圖像編輯功能,亦不會改動某人的頭巾。Gemini起初沒有照直接要求做,但在被要求令女性看起來更「西方」後,便移除了頭巾。
1
9
這次測試的背景,是一名法國極右翼政客曾用AI移除一張照片中穆斯林女性的頭巾。
3
提示語一轉,結果可以一樣
四個聊天機械人的反應並不一致:ChatGPT和Grok照直接要求執行,Claude拒絕,而Gemini的反應則隨提示語改變。這個結果顯示,即使沒有明言要移除宗教服飾,以「改變外表」為由提出的要求,仍可能導致相同結果。
1
9
目前報道提供的資料,集中在移除頭巾,以及要求令女性看起來更「西方」的提示;並沒有足夠細節說明各個聊天機械人收到移除裙子或其他宗教服飾要求時如何回應。因此,不宜把這次結果推論到未有測試或報道的情況。
同意與個人形象
《衛報》這次用的是AI生成圖像,並非某位真實人士的照片;測試本身因此不能證明聊天機械人曾在這次測試中擅自修改真人照片。不過,若未經當事人同意,就把真人照片中的宗教服飾改掉,便可能扭曲對方選擇如何呈現自己的方式。
Grok早前亦因生成或協助製作女性及兒童照片的非自願色情化修改而受到關注,當中包括移除或加上衣物的要求。這些報道談的是另一批事件,並非今次頭巾測試。
5
7
這次測試能說明甚麼?
測試記錄了聊天機械人面對一項特定圖像編輯要求時的不同反應。它提醒人們,提示語的寫法可能左右編輯結果;但這不是對各個聊天機械人的全面審核,也不能證明它們在所有情況下都會作出同樣反應。
較重要的啟示是,安全防護除了要處理直接要求,也要留意那些字眼不同、卻可能造成相同修改效果的間接提示。