В документации OpenAI есть страница модели GPT Image 1.5; она описывает GPT Image 1.5 как модель генерации изображений и упоминает улучшенное следование инструкциям и промптам. Также доступна страница OpenAI API для GPT Image 2.
Справочник Images API показывает наличие операций для генерации изображения и редактирования изображения — Generate an Image и Edit an Image. В Python- и TypeScript-разделах Images API также упоминаются параметры и поля, связанные с GPT image models, включая размер сгенерированного изображения, настройки background, output format и quality.
Этого достаточно, чтобы подтвердить: в API действительно есть инфраструктура для генерации и редактирования изображений, а тема размера изображения присутствует в справочнике. Но этого недостаточно, чтобы вывести полный список допустимых размеров для GPT Image 1.5 и GPT Image 2 или доказать, что у GPT Image 2 эти ограничения шире.
В доступных материалах нет официального сопоставления GPT Image 1.5 и GPT Image 2 по следующим пунктам:
size или аналогичные параметры ширины и высоты;Поэтому более аккуратная формулировка такая: GPT Image 2 может иметь другие улучшения, но степень «свободы» по размерам, пропорциям и референсам на основе этих источников не поддается количественной оценке.
| Вопрос | Что видно в источниках | Можно ли доказать, что GPT Image 2 свободнее? |
|---|---|---|
| Пользовательские размеры | В справочнике OpenAI Images упоминается size; в сторонних документах по GPT Image 1.5 встречаются width, height, image_size и size для edit-сценариев. | Нет. Эти данные не дают полного официального списка поддерживаемых размеров для GPT Image 1.5 и GPT Image 2, а также не показывают максимумы, минимумы или поддержку произвольной ширины и высоты. |
| Соотношение сторон | В гайде Higgsfield для GPT Image 1.5 приведены UI-варианты 1:1, 2:3 и 3:2. | Нет. Это пример интерфейса сторонней платформы, а не официальная таблица OpenAI по двум поколениям моделей. Из него нельзя вывести, что GPT Image 2 поддерживает больше пропорций. |
| Референсные изображения | У OpenAI есть endpoint для редактирования изображения; сторонние документы показывают поля вроде image_reference и input_fidelity. |
Документация Leonardo.AI по GPT Image-1.5 показывает пример REST API с width, height, seed и guidances.image_reference. В документации fal встречаются image_size, background и quality. WaveSpeedAI для edit-сценария указывает size, quality, input_fidelity и output_format. Higgsfield в пользовательском гайде перечисляет варианты aspect ratio 1:1, 2:3 и 3:2.
Эти материалы полезны, если вы изучаете конкретные интеграции. Но это не то же самое, что нативная спецификация OpenAI. Сторонняя платформа может переименовывать параметры, задавать собственные значения по умолчанию, ограничивать интерфейс ради удобства или, наоборот, оборачивать несколько внутренних шагов в один параметр. Поэтому width/height, image_size или выпадающий список пропорций в стороннем сервисе нельзя напрямую считать полным набором возможностей GPT Image 1.5 — и тем более доказательством того, что GPT Image 2 отличается в ту или иную сторону.
Чтобы уверенно сказать, что GPT Image 2 стал свободнее GPT Image 1.5, нужны более сильные данные. Например:
size по обеим моделям;Пока таких данных в приведенных источниках нет, тезис «GPT Image 2 дает больше свободы по параметрам» лучше считать гипотезой, а не подтвержденным продуктовым фактом.
Если вы выбираете, переходить ли с GPT Image 1.5 на GPT Image 2, не стоит строить решение только на предположении о более свободных размерах или референсах. Разумнее разнести оценку на несколько независимых блоков: качество картинки, следование промпту, скорость, стоимость, стабильность API и реальные ограничения параметров.
Для проверки API-ограничений лучше собрать тестовую матрицу: один набор промптов и ассетов, затем пошагово менять размер, пропорцию, количество референсных изображений и формат входного файла. Важны не только успешные генерации, но и отказы, коды ошибок и тексты сообщений. Только после официальной таблицы параметров или воспроизводимых тестов корректно писать в публичных материалах, что GPT Image 2 поддерживает больше размеров или имеет более мягкие правила для референсов.
На данный момент аккуратнее всего формулировать так: документация OpenAI подтверждает наличие страниц GPT Image 1.5 и GPT Image 2, а также эндпоинтов для генерации и редактирования изображений; однако доступные источники не дают полного официального сравнения двух моделей по пользовательским размерам, aspect ratio и входным референсным изображениям. Поэтому доказать измеримое расширение свободы параметров у GPT Image 2 по сравнению с GPT Image 1.5 пока нельзя.
| Нельзя количественно оценить. В источниках нет официального сравнения лимитов по числу референсов, форматам, размеру файлов или правилам multi-image input для GPT Image 1.5 и GPT Image 2. |