| السنة | نظام الذكاء الاصطناعي | الدرجة / 42 | مستوى الميدالية | ملاحظات |
|---|---|---|---|---|
| 2024 | AlphaProof / AlphaGeometry من Google DeepMind | 28 | فضية | حل 4 من 6 مسائل؛ نقطة واحدة عن الذهبية |
| 2025 | Gemini Deep Think من Google DeepMind | 35 | ذهبية | أول ميدالية ذهبية للذكاء الاصطناعي؛ حل 5 من 6 مسائل |
| 2025 | نموذج استدلال تجريبي من OpenAI | 35 | ذهبية | حقق أيضًا مستوى ذهبية في 2025 |
| 2026 | dots-note-3.0 من RedNote | 42 | ذهبية (كاملة) | أول درجة كاملة في تاريخ IMO |
| 2026 | نموذج هواوي للذكاء الاصطناعي | 42 | ذهبية (كاملة) | حقق أيضًا 100% على نفس المسائل |
الاختلافات الرئيسية:
تحذير مهم: النموذج dots-note-3.0 لم يشارك في مسابقة IMO الرسمية جنبًا إلى جنب مع 666 متسابقًا بشريًا . تقيد اللوائح العامة لـ IMO المشاركة بالدول المدعوة والمتسابقين البشر تحت سن 20 . بدلاً من ذلك، تُعطى الشركات التقنية نفس المسائل بعد أن يكمل المتسابقون البشريون الامتحان، وتُقيّم حلولهم من قبل مصححي IMO .
في عام 2025، لم تضع لجنة IMO قواعد رسمية لمشاركة الذكاء الاصطناعي، مما سمح لكل شركة بتحديد شروط الاختبار الخاصة بها – مما دفع علماء رياضيات إلى ملاحظة أن هذا مكن الشركات من "وضع اختباراتها وتصحيحها بأنفسها" . نفس العملية غير الرسمية تنطبق على عام 2026. كما وصف أحد التحليلات، النموذج dots-note-3.0 "لم يدخل المسابقة بالمعنى التقليدي" – بل حل المسائل لاحقًا تحت بروتوكولات اختبار تحددها الشركة .
ذكرت RedNote أن حلول نموذجها قُدمت للتصحيح الرسمي من IMO وحصلت على الدرجة الكاملة من نفس الحكام الذين يصححون للمتسابقين البشر . تم التحقق من نموذج هواوي بالمثل. يوفر هذا طبقة ذات مغزى من المصداقية، حيث أن المصححين مستقلون وتم تقييم الحلول وفقًا لنفس معايير التصحيح.
الإنجاز حقيقي بمعنى أن النموذج أنتج حلولاً صحيحة ومصححة من IMO لجميع المسائل الست. لكنها ليست ميدالية IMO رسمية – فـ IMO لا تمنح ميداليات رسميًا لأنظمة الذكاء الاصطناعي. المقارنة بنتائج الذكاء الاصطناعي السابقة عادلة لأن تلك الأنظمة حلت أيضًا نفس المسائل لاحقًا في ظروف مماثلة، لكن يجب فهم جميع "ميداليات IMO الذهبية للذكاء الاصطناعي" على أنها معايير غير رسمية، تم تقييمها بأثر رجعي، وليست فوزًا مباشرًا في مسابقة حية. ومع ذلك، فإن نتيجة dots-note-3.0 تُعتبر علامة فارقة مهمة كأول مرة يصل فيها أي ذكاء اصطناعي إلى درجة كاملة على مجموعة كاملة من مسائل IMO.