目前没有足够证据可以说 GPT Image 2 一定比 GPT Image 1.5 更具照片真实感。这里的判断是**“尚未证明”**,并不是说 GPT Image 2 更差。
真正缺失的是一组可以复现的直接比较:同一批提示词、可比的生成设置、每个提示词生成多个样本、盲评流程,以及专门针对“照片真实感”的评分方法。已审阅的 OpenAI 资料记录了 GPT Image 1.5 和 API 工作流,但没有给出 GPT Image 2 的官方照片真实感对比。
OpenAI 的 GPT Image 1.5 模型页面把 GPT Image 1.5 描述为“state-of-the-art image generation model”,并称其为 OpenAI 最新的图像生成模型,具备更好的指令遵循和提示词贴合能力。
OpenAI 的图像生成指南记录了两类核心流程:根据文本提示从零生成图像,以及编辑已有图像。 API 参考文档也说明了图像编辑输入和参数,例如模型、生成图片数量、质量、输出格式等 GPT 图像模型工作流相关设置。 OpenAI cookbook 和提示词材料则提供了实际使用示例,包括蒙版编辑和 GPT Image 1.5 提示词案例。
这些资料能证明 GPT Image 1.5 的产品能力和使用方式。它们不能证明 GPT Image 2 比 GPT Image 1.5 更写实,因为其中没有 GPT Image 2 的官方模型页、官方 GPT Image 2 基准,也没有两者的正面照片真实感研究。
已审阅的 GPT Image 2 页面,并没有提供足以验证写实升级的证据。
其中一篇文章以泄露和工作流指南为核心来讨论 GPT Image 2。 另一篇文章谈的是“可以期待的升级”,包括文字渲染和相机控制改进。 MindStudio 的文章称,GPT Image 2 在文字渲染改进上似乎领先,但这只是“文字渲染”这一维度,不等同于照片真实感。 JXP 的文章提出更强的说法,包括“99%+”文字准确率、预期原生 4K 输出,以及照片真实感和指令遵循的大幅跃升;但所提供片段没有展示可复现的评测方法,也没有给出与 GPT Image 1.5 的直接对比。 Higgsfield 页面则围绕商业图像生成和“完美文字”来营销 GPT Image 2。
问题在于,文字渲染、提示词遵循、分辨率、商业可用性,并不等于照片真实感。一个模型可能更擅长排版或听懂复杂指令,但不一定在“看起来像真实照片”这件事上有可测量的提升。现有 GPT Image 2 来源没有提供提示词集合、样本数量、生成设置、盲评方法,也没有给出专门针对照片真实感、并与 GPT Image 1.5 对照的评分结果。
在现有资料中,最像“榜单式证据”的来源是 Artificial Analysis。其 Text to Image Arena 片段显示,GPT Image 1.5(high)目前以 Elo 1274 排在第一;该榜单基于盲测用户投票,Elo 越高表示模型更常被用户偏好。
这对理解用户偏好有参考价值。但它仍然不能证明 GPT Image 2 的照片真实感更强。这里给出的 Artificial Analysis 片段是整体文生图偏好榜单,而不是 GPT Image 2 与 GPT Image 1.5 的“仅照片真实感”专项基准。
| 证据 | 能支持什么 | 不能证明什么 |
|---|---|---|
| OpenAI GPT Image 1.5 模型页 | GPT Image 1.5 被官方记录为先进图像生成模型,并具备更好的指令遵循和提示词贴合能力。 | 不能证明 GPT Image 1.5 与 GPT Image 2 的对比结果。 |
| OpenAI 图像生成与 API 文档 | OpenAI 支持图像生成和图像编辑工作流,API 材料中包含模型、质量、输出格式等参数。 | 工作流文档不是照片真实感基准测试。 |
| OpenAI cookbook 与提示词指南 | 材料展示了 GPT 图像模型用法、蒙版编辑和 GPT Image 1.5 提示词示例。 | |
| 第三方 GPT Image 2 页面 | 讨论泄露、预期升级、文字渲染、商业访问和广泛性能主张。 | |
| Artificial Analysis Text to Image Arena | GPT Image 1.5(high)在盲测投票偏好榜中以 Elo 1274 位列第一。 | 这里没有显示它是 GPT Image 2 与 GPT Image 1.5 的照片真实感专项比较。 |
如果要做足以支撑决策的 GPT Image 2 vs GPT Image 1.5 对比,评测必须把“照片真实感”从其他能力中拆出来。至少应包括:
如果你正在为生产环境评估图像模型,应把“GPT Image 2 更写实”先当作待验证假设。OpenAI 的资料提供了 GPT Image 1.5 的官方基线,也说明了图像生成和编辑工作流,但并没有证明 GPT Image 2 的写实升级。
如果两个模型都能在同一工作流中使用,最好用自己的提示词做内部测试。生产迁移时,不应只因为第三方页面声称“写实能力飞跃”就更换模型。营销文案也应避免直接宣称 GPT Image 2 更具照片真实感,除非你手上有透明、可复现的基准测试来支撑这一说法。
GPT Image 2 未来可能被证明更强,但现有资料还不能验证它比 GPT Image 1.5 更具照片真实感。更稳妥的说法是:GPT Image 1.5 已被 OpenAI 官方文档记录;Artificial Analysis 将 GPT Image 1.5(high)以 Elo 1274 列在盲测投票 Text to Image Arena 第一位;而已审阅来源中,没有任何一份能证明 GPT Image 2 在照片真实感上优于 GPT Image 1.5。
| 没有提供 GPT Image 2 与 GPT Image 1.5 的并排写实测试。 |
| 已审阅片段没有提供受控的 GPT Image 2 vs GPT Image 1.5 照片真实感评估。 |