هذا لا يثبت أن اسماً رمزياً مثل «Spud» لم يُستخدم داخلياً قط. لكنه يعني أن أي حديث عام عن موعد إطلاق Spud، أو تفوقه في الاختبارات، أو امتلاكه قدرات أفضل في «تأريض» الصور والوثائق، يبقى غير مثبت ما لم تنشر OpenAI وثائق رسمية عنه.
أقوى الأدلة الرسمية المتاحة تقود إلى GPT-5.4. صفحة النموذج لدى OpenAI تصف GPT-5.4 بأنه نموذجها المتقدم للأعمال المهنية المعقدة، كما أن دليل أحدث نموذج وفهرس النماذج يوجهان المستخدمين إلى GPT-5.4 .
في المقابل، الإشارات الخاصة بـ Spud في مجموعة المصادر هذه تأتي من مواقع عامة ومنشورات مستخدمين على Reddit وX ومقاطع YouTube، لا من صفحات نماذج رسمية أو بطاقات نموذج أو تقارير اختبارات منشورة من OpenAI . لذلك فالقراءة الأكثر أماناً هي: GPT-5.5 «Spud» اسم متداول في الشائعات، وليس نموذجاً عاماً موثقاً حتى الآن.
| الادعاء | الحالة | ما الذي تدعمه المصادر؟ |
|---|---|---|
| GPT-5.5 «Spud» نموذج عام ورسمي من OpenAI | غير مثبت | المصادر الرسمية التي تمت مراجعتها توثق GPT-5.4، ولا تعرض صفحة نموذج باسم GPT-5.5 أو Spud . |
| Spud قريب الإطلاق أو تم التحقق منه بالفعل | غير مؤكد | الإشارات إلى Spud هنا تأتي من الويب العام أو من محتوى اجتماعي وفيديوهات ينشئها المستخدمون . |
| لدى OpenAI توثيق لسير عمل متعدد الوسائط في فهم الوثائق | مثبت لـ GPT-5.4 | توفر OpenAI إرشادات لـ GPT-5.4 في فهم الصور والوثائق، إلى جانب نصائح للصور الكثيفة أو المهام الحساسة للموقع داخل الصورة . |
| Spud أفضل من GPT-5.4 في تأريض الصور والوثائق | غير مدعوم هنا | الوثائق الرسمية التي راجعناها تدعم إرشادات GPT-5.4، لكنها لا تقدم أدلة قدرات أو اختبارات خاصة بـ Spud . |
تقول صفحة GPT-5.4 الرسمية إن النموذج مخصص للأعمال المهنية المعقدة . وتوفر OpenAI أيضاً صفحة إرشادية ضمن الـ Cookbook عن استخدام GPT-5.4 في الرؤية وفهم الوثائق . في المواد المسترجعة، ترتبط هذه الإرشادات بأمثلة مثل استخراج بيانات منظمة من نموذج تأمين مكتوب بخط اليد، والاستدلال المكاني على مخطط شقة، وفهم الرسوم البيانية، واستخراج مربعات إحاطة من نموذج شرطة .
أهمية هذه الأمثلة أنها تذهب أبعد من مجرد قراءة النص. في العمل الحقيقي على الوثائق، لا يكفي أن يلخص النموذج صفحة ما بلغة سليمة؛ المطلوب أن يربط الإجابة بدليل مرئي: اسم الحقل وقيمته، خلية داخل جدول، علامة في رسم بياني، كتابة يدوية، ترتيب الصفحة، أو موضع عنصر معين. ومع ذلك، فالمواد الخاصة بـ GPT-5.4 التي تمت مراجعتها هنا هي إرشادات وعروض من OpenAI، وليست تقرير اختبار مستقلاً ومدققاً يغطي كل سيناريو إنتاجي ممكن .
كما تقدم OpenAI نصيحة عملية مهمة للتقييم: استخدام مستوى تفاصيل الصورة original مع الصور الكبيرة أو الكثيفة أو الحساسة مكانياً، خصوصاً في مهام استخدام الحاسوب، وتحديد المواقع، وOCR، ودقة النقر . بعبارة أبسط: إذا كانت المهمة تعتمد على نص صغير، أو جدول مزدحم، أو خانة في نموذج، فقد تخسر الدقة إن ضغطت الصورة أو قصصتها أو أزلت تفاصيل يحتاج النموذج إلى رؤيتها.
OCR يعني غالباً قراءة النص من الصورة. أما التأريض متعدد الوسائط فيعني ربط النص بالتخطيط والموقع والبنية البصرية والاستدلال، ثم إخراج إجابة يمكن التحقق منها على الصفحة نفسها.
الأبحاث في فهم الوثائق تدعم هذا التمييز. تقييمات فهم الوثائق تشمل فهم النماذج، وتحليل الإيصالات، والإجابة عن أسئلة بصرية حول الوثائق أو ما يعرف بـ Document VQA . أما الوثائق متعددة الصفحات فقد تتطلب من النموذج أن ينتقل بين الصفحات، ويسترجع المحتوى المناسب، ويفحص صفحات محددة، لا أن يعتمد على لقطة واحدة أو صفحة واحدة فقط .
لهذا السبب لا يكفي عرض لقطة شاشة مبهر لإثبات قدرة نموذج في بيئة عمل حقيقية. التقييم الجاد يجب أن يغطي نوع الوثائق الفعلي، وجودة المسح، وعدد الصفحات، والكتابة اليدوية، والجداول، والرسوم البيانية، والنصوص الصغيرة، والحالات التي قد يفشل فيها النظام.
original للصور الكبيرة أو الكثيفة أو الحساسة مكانياً، مثل OCR، وتحديد المواقع، ودقة النقر، ومهام استخدام الحاسوب .اسم «Spud» حاضر في تغطيات أقرب إلى الشائعات، لكنه غير موثق كنموذج عام ورسمي من OpenAI في المصادر التي راجعناها. النتيجة العملية أضيق وأكثر فائدة: قيّم GPT-5.4 في سير العمل الموثق لفهم الصور والوثائق، وتعامل مع ادعاءات GPT-5.5 «Spud» حول التأريض متعدد الوسائط كادعاءات غير مثبتة إلى أن تنشر OpenAI صفحة نموذج رسمية، أو دليلاً، أو بطاقة نموذج، أو تقرير اختبارات لهذا الاسم .