Если вам нужно написать текст для интерфейса, документации или серверной валидации, самая аккуратная формулировка такая:
Сценарии GPT Image 2 Edit в принципе поддерживают множественный ввод изображений, но в проверенных официальных справках OpenAI не опубликован числовой максимум исходных изображений для одного запроса.
Ключевой момент — именно формулировка image(s) to edit в Python API reference. Она не выглядит как ограничение «только одно изображение». Но это также не лимит. Превращать ее в обещание вроде «можно загрузить до 10 референсов» нельзя, если такой предел не указан в документации конкретного провайдера.
Путаница часто возникает из-за того, что в image API есть два разных счетчика:
Некоторые документы говорят о количестве изображений, которые нужно сгенерировать, а не о количестве изображений, которые можно загрузить на вход. Например, OpenAI-совместимая справка Zenlayer для image edit указывает, что «number of images to generate» должен быть от 1 до 10. Это настройка выходных изображений, а не лимит на число загружаемых референсов.
Пример OpenVINO с OpenAI-совместимым endpoint показывает ту же разницу: в запрос отправляется один файл через image=@three_cats.png, а отдельно используется n=4, чтобы получить несколько результатов. Пример с одним входным файлом не доказывает, что входной файл может быть только один; и n=4 не означает, что принимаются четыре исходных изображения.
Страницы провайдеров полезны для интеграции, но их нельзя автоматически считать официальными лимитами OpenAI — особенно если они не публикуют конкретное ограничение.
У Fal на странице openai/gpt-image-2/edit в примере запроса есть массив image_urls. Это согласуется с формой поля, рассчитанной на несколько изображений, но в самом показанном примере указан один URL и не опубликован максимум исходных изображений.
WaveSpeedAI описывает сценарии GPT Image 2 Edit, где можно смешивать несколько референсов, но это описание провайдера, а не числовой официальный лимит OpenAI на входные изображения.
FAQ OpenAI по Image Inputs в ChatGPT говорит, что число изображений, которые пользователь может добавить в разговор, зависит от разных факторов, включая размер файлов. Но это про поведение пользовательского интерфейса ChatGPT, а не про тот же самый лимит в Images API для edit-методов. Смешивать эти два случая опасно: можно заложить в код неверную валидацию.
Для разработчика это практическая, а не теоретическая разница. Ограничение в ChatGPT, схема стороннего API-провайдера и прямой вызов OpenAI Images API могут отличаться. Проверять нужно ту систему, к которой реально идет запрос.
n, output count или «images to generate». На основании проверенных документов ответ сейчас не выражается одним числом. Официальные справки OpenAI по редактированию изображений используют формулировку image(s) to edit, то есть допускают множественный вход по смыслу, но не публикуют максимальное количество исходных изображений для одного edit-запроса.