GPT Image 1.5 有可引用的 OpenAI API 模型頁;該頁把它描述為圖像生成模型,並稱它有更好的 instruction following 和對 prompts 的 adherence。 GPT Image 1 的官方模型頁則稱它是 previous image generation model,並說它可接受文字及圖像輸入、產生圖像輸出。
OpenAI 的圖像生成文件亦把工作流分為兩類:Generations,即由文字 prompt 從零生成圖像;以及 Edits,即修改既有圖像。 這點對評估很重要,因為「由文字生成一張複雜構圖」和「在既有圖像中準確移動或加入物件」不是同一種任務。
在可核查的 OpenAI API changelog、Models 與 All models 來源摘錄中,未見官方公布 GPT Image 2 vs GPT Image 1.5 的 complex composition、spatial accuracy 或 multi-object placement 量化比較。 因此,嚴格來說,目前只能支持「GPT Image 1.5 是有官方模型頁的圖像模型」;不能支持「GPT Image 2 擺位準確率提升 X%」這類結論。
GPT Image 2 的難點不是完全沒有人討論,而是公開來源之間說法未一致。Mew Design 的整理採取較保守說法,指 GPT Image 2 看似在測試,但未作為具名 OpenAI 模型正式公開。 getimg.ai 亦稱 OpenAI 未宣布 GPT Image 2,公開 lineup 停在 gpt-image-1.5。 但另一篇第三方文章則聲稱 OpenAI 在 2026 年 4 月 21 日推出 ChatGPT Images 2.0 / gpt-image-2,並提到 Arena score 1512。
第三方評測也有類似問題。RenovateQR 的文章摘錄稱作者用一批標準 prompts 測試 GPT Image 2,任務包括產品攝影、UI mockup、多語 signage、肖像與品牌內容等。 不過,該摘錄未提供可重現的多物件擺位成功率、左右/前後關係準確率,或與 GPT Image 1.5 的完整對照表。
所以,較穩陣的寫法是:有第三方來源聲稱 GPT Image 2 存在、測試中或已推出,但就「複雜構圖和物件擺位準確度提升幾多」而言,現有資料未能提供官方、可重現、專項量化答案。
有第三方頁面列出 GPT Image 2 分數為 1,512,GPT Image 1.5 分數為 1,241,相差 271 分。 這可以作為「有來源聲稱 GPT Image 2 整體分數較高」的線索,但不能直接改寫成「擺位準確度提升 271 分」或「擺位準確率提升某個百分比」。
原因很簡單:
換句話說,若文章、產品頁或銷售材料要準確,最多可以說「有第三方頁面列出 GPT Image 2 分數較 GPT Image 1.5 高」。不應寫成「官方證明 GPT Image 2 擺位準確度提升 X%」。
要真正回答 GPT Image 2 是否比 GPT Image 1.5 更擅長複雜構圖,測試需要比「看起來更靚」嚴格得多。至少應包括:
沒有這些條件,單張示例圖、社交平台截圖或一個總分,都不足以回答「擺位準確咗幾多」。
在未有官方或可重現第三方 benchmark 前,不應把「GPT Image 2 擺位更準」當成已量化事實。較安全的流程是:
現有來源支持的最強結論是:GPT Image 1.5 有可引用的 OpenAI API 模型頁,並被描述為有更好的 prompt adherence;GPT Image 1 則是上一代圖像生成模型。 但 GPT Image 2 相對 GPT Image 1.5 在複雜構圖與物件擺位方面準確提升幾多,暫時未有足夠可核查公開數據。第三方來源對 GPT Image 2 的狀態與分數說法不一,而 1,512 vs 1,241 這類總分不能直接當成 spatial accuracy 或 object-placement accuracy。