أعلنت Microsoft في 9 أكتوبر 2026 عن Microsoft-Decision-1، وهو نموذج متخصص لا يكتب إجابات مطولة، بل يختار بين خيارات محددة مسبقًا ويمنح كل خيار احتمالًا في تمريرة واحدة.
1
14 صُمم لمهام مثل التصنيف وتوجيه الطلبات والتقييم؛ وهي مهام تحتاج فيها التطبيقات غالبًا إلى اختيار قابل للاستخدام مباشرة، لا إلى فقرة تشرح القرار.
1
كيف يقيّم النموذج الخيارات؟
يقدّم التطبيق للنموذج سياقًا ومجموعة إجابات محددة، فيعيد احتمالًا لكل خيار بدلًا من إنشاء نص حر.
14 تساعد هذه الدرجات التطبيق على ترتيب الخيارات أو اختيار أحدها، لكنها ليست ضمانًا لصحة النتيجة.
تشمل صيغ المهام المذكورة أسئلة نعم أو لا، والاختيار من متعدد، والتقييم، والتصنيف، ومنح الدرجات وفق معيار محدد.
6
22 وعلى المطورين مراجعة وثائق النموذج للتأكد من صيغة الإدخال والإخراج المناسبة لتطبيقاتهم.
على سبيل المثال، يمكن لنظام دعم العملاء عرض فئات توجيه مختلفة على النموذج واستخدام درجاته لاختيار الجهة المناسبة. وفي سير عمل يعتمد على وكيل ذكاء اصطناعي، قد تساعد الدرجات في الاختيار بين تنفيذ خطوة، أو إعادة المحاولة، أو إحالة الحالة إلى مراجعة بشرية. هذه أمثلة على طرق استخدام محتملة، وليست دليلًا بحد ذاتها على تسريع مضمون للنظام بأكمله.
لماذا نموذج قرارات بدلًا من نموذج محادثة؟
لا تتطلب كل خطوة في البرنامج كتابة شرح أو إجراء محادثة. أحيانًا يكون المطلوب ببساطة تحديد فئة، أو اختيار مسار، أو تقييم إجابة. وتصف Microsoft نموذج Decision-1 بأنه مخصص لمهام القرار والتصنيف، بما فيها التوجيه والتقييم.
1
هذا التخصص يوضح أيضًا حدوده: فهو ليس بديلًا عن نموذج يُطلب منه صياغة محتوى أو شرح إجابة أو إجراء حوار مفتوح. وقد تستخدم الفرق نموذجًا مولّدًا للنصوص لإنشاء المحتوى، ونموذجًا مثل Decision-1 لاتخاذ قرار ضيق ومحدد ضمن سير العمل.
الأساس التقني والتوافر والسعر
تقول Microsoft إن Decision-1 مبني على Qwen3.5-9B من Alibaba، مع تدريب إضافي يركز على تقييم القرارات.
1 وأدرجت الشركة النموذج في كتالوج Microsoft Foundry ضمن مرحلة المعاينة العامة.
1
السعر المنشور هو 0.042 دولار لكل مليون رمز إدخال، من دون رسوم على رموز الإخراج.
11 وتعتمد جدوى هذه الكلفة على طبيعة الاستخدام، ومنها حجم السياق الذي يرسله التطبيق وعدد مرات طلب القرار.
ماذا تقول نتائج الأداء؟ وما حدودها؟
تقول Microsoft إن Decision-1 حقق أعلى دقة في مقارنتها عبر 36 معيارًا اختباريًا شملت قرابة 150 ألف سؤال. كما أفادت بأن زمن الاستجابة في اختبارات الشركة كان أسرع 4.5 مرات من Quyet-1.0-Large و35 مرة من GPT-6 Sol.
12
5
هذه نتائج أبلغت عنها الشركة، وليست تأكيدًا مستقلًا على أن النموذج سيكون أسرع أو أدق في كل تطبيق. فقد تختلف النتائج باختلاف المهام والنماذج المقارنة وإعداد الاختبار. لذلك يُستحسن أن تختبر الفرق النموذج على بياناتها، وتقيس جودة قراراته وزمن الاستجابة وتبعات الاختيارات الخاطئة قبل الاعتماد عليه في سير عمل فعلي.
الفكرة الأساسية واضحة: حين تكون المهمة اختيارًا من قائمة محددة، قد يكون نموذج صُمم لتقييم تلك الخيارات أنسب من نموذج عام يُطلب منه كتابة شرح في كل مرة. أما فائدته العملية، فستتوقف على مدى موثوقيته في القرارات التي يحتاج التطبيق إلى اتخاذها.