OpenAI 有 GPT Image 2 嘅 API 模型頁面。 同時,OpenAI 亦有 GPT Image 1.5 嘅 API 模型頁面,並形容 GPT Image 1.5 係先進圖像生成模型,重點包括更好嘅指令跟從能力同 prompt adherence。 OpenAI 嘅圖像生成指南亦涵蓋由文字 prompt 生成圖像,以及編輯現有圖像兩類流程。
呢啲資料足以說明:兩個模型都可以放入同一個創意製作 workflow 去比較。但呢一點,未足以推論 GPT Image 2 對 campaign variations、social ads、產品視覺、landing page graphics,或者其他需要品牌審批嘅素材一定更可靠。
真正欠缺嘅,是一個用同一輸入去比較 GPT Image 2 同 GPT Image 1.5 嘅公開測試:包括清楚 pass/fail rubric、首稿通過率、以及每個任務平均要重試幾多次。OpenAI 嘅 image-evals cookbook 與圖像生成及編輯評估有關,但現有資料未提供針對呢兩個模型嘅 marketing-specific head-to-head 結果。
| 資料 | 可以支持嘅結論 | 唔能夠證明嘅事 |
|---|---|---|
| GPT Image 2 API 模型頁面 | GPT Image 2 係 OpenAI 有文件記錄嘅 API 模型。 | 單憑呢頁,唔能夠證明佢有較高 marketing 可靠性 benchmark。 |
| GPT Image 1.5 API 模型頁面 | OpenAI 將 GPT Image 1.5 定位於圖像生成、指令跟從同 prompt adherence。 | 唔能夠證明 GPT Image 1.5 同 GPT Image 2 邊個喺 marketing 任務表現較好。 |
| 圖像生成指南 | OpenAI 有記錄由文字生成圖像,以及編輯現有圖像嘅流程。 | 無比較兩個模型喺素材審批結果上嘅差異。 |
| ChatGPT Images 2.0 相關資料 | OpenAI 推出 ChatGPT Images 2.0;其 FAQ 稱 ChatGPT Images 係由其目前最佳圖像生成模型支援嘅新改良版本,system card 亦討論安全評估。 | 呢啲唔等於 GPT Image 2 對 GPT Image 1.5 嘅 marketing-readiness benchmark。 |
重點好簡單:發布用語同模型文件,可以支持「值得評估」;但唔可以代替任務層面嘅實證。
Marketing-ready 素材有一堆實際限制,唔係一般「畫質更好」就夠。審圖時應該問:
OpenAI 嘅 GPT Image 1.5 prompting guide 顯示,呢類 workflow 可以好重限制:示例 prompt 包括「只用原創設計」、「不可有商標」、「不可有水印」、「不可有 logo」,以及包裝文字要逐字照放等要求。 呢啲限制同 marketing QA 好相關,但佢哋係 prompt 設計指引,唔係證明任何一個模型一定較易通過品牌審批。
一個可信嘅比較,唔可以只睇模型名或者官方示例。至少要有:
目前資料記錄咗模型本身,亦有指出圖像評估概念,但未有公布呢種針對 marketing 場景嘅比較。
較穩陣嘅做法,是將 GPT Image 2 視為一個候選模型,而唔係自動替代 GPT Image 1.5。可以用團隊已熟悉嘅工作做 pilot:
GPT Image 2 可能會喺某啲 marketing workflow 表現更好,但目前公開證據未足以證明呢個講法。較準確嘅 source-backed 結論係:GPT Image 2 同 GPT Image 1.5 都有文件記錄;OpenAI 嘅圖像文件涵蓋生成同編輯;OpenAI 亦提供圖像評估相關指引。 喺未有同 prompt、同任務、同審批標準嘅 marketing benchmark 之前,負責任嘅答案係:先測試,再轉用。