إن كنت تكتب توثيقاً لمنتج، أو تبني تحققاً في الواجهة، أو تضع عبارة في صفحة تسعير، فالصياغة الآمنة هي:
تدعم مسارات GPT Image 2 Edit إدخال صور بصيغة الجمع من حيث المبدأ، لكن المراجع الرسمية التي تمت مراجعتها لا توثق حداً رقمياً لعدد صور المصدر في طلب تحرير واحد.
النقطة الحاسمة هي عبارة OpenAI «image(s) to edit» في مرجعية Python. هذه العبارة مهمة لأنها لا تصف الحقل كأنه مخصص لصورة واحدة فقط. لكنها في الوقت نفسه ليست وعداً مثل «حتى 10 صور مصدر»، ولا ينبغي استخدامها لصناعة رقم غير منشور.
جزء كبير من الالتباس يأتي من خلط رقمين مختلفين:
بعض المراجع تتحدث عن عدد الصور المراد توليدها، لا عن عدد الصور التي يمكن رفعها كمدخلات. فمثلاً، مرجع Zenlayer المتوافق مع OpenAI يقول إن «عدد الصور المراد توليدها» يجب أن يكون بين 1 و10؛ وهذا إعداد للنتائج، لا سقفاً لصور المصدر.
مثال OpenVINO المتوافق مع واجهة تحرير الصور يوضح الفرق نفسه: يرسل ملفاً واحداً عبر image=@three_cats.png، ثم يستخدم n=4 لطلب عدة مخرجات. وجود مثال بصورة مصدر واحدة لا يثبت أن الحد الأقصى هو صورة واحدة، وn=4 لا يعني أن أربع صور مصدر مقبولة.
قد تكون منصات الطرف الثالث مفيدة عند التنفيذ، خصوصاً إذا كانت توفر «غلافاً» أو واجهة متوافقة مع OpenAI. لكنها لا تصبح تلقائياً مرجعاً لحدود OpenAI الرسمية إلا إذا قالت ذلك بوضوح.
صفحة Fal لنموذج openai/gpt-image-2/edit تعرض حقلاً باسم image_urls على شكل مصفوفة في مثال الطلب، وهذا ينسجم مع شكل يسمح بأكثر من رابط. لكن المثال المعروض يحتوي رابطاً واحداً فقط ولا ينشر حداً أقصى لعدد صور المصدر.
أما WaveSpeedAI فتصف استخدامات GPT Image 2 Edit باعتبارها قادرة على مزج مراجع متعددة، لكن هذا وصف مزود خارجي لسير العمل، وليس رقماً رسمياً لحد OpenAI في صور المصدر.
تقول صفحة الأسئلة الشائعة من OpenAI حول مدخلات الصور في ChatGPT إن عدد الصور التي يمكن إضافتها إلى محادثة يعتمد على عوامل عدة، منها حجم الصور. هذا يتناول سلوك واجهة ChatGPT في المحادثة، لا بالضرورة حد واجهة Images API الخاصة بطلبات التحرير. الخلط بينهما قد يؤدي إلى قواعد تحقق خاطئة في تطبيقك.
بالنسبة للمطورين، قد تكون هناك ثلاثة حدود مختلفة عملياً: حد واجهة ChatGPT، وحد مزود وسيط مثل Fal أو WaveSpeedAI، وحد نقطة النهاية التي تستدعيها مباشرة في Images API. لذلك لا تبنِ قاعدة عامة واحدة وتفترض أنها تنطبق على الجميع.
n أو أي إعداد يسمى «عدد الصور المراد توليدها». الإجابة الموثقة حالياً ليست رقماً. صياغة OpenAI «image(s) to edit» تدعم فكرة إدخال أكثر من صورة من حيث المبدأ، لكن المراجع الرسمية التي تمت مراجعتها لا تنشر حداً أقصى عددياً لصور المصدر في طلب GPT Image 2 Edit واحد.