هذه قصة ذلك الإطلاق: ما يمكن أن يفعله النموذج فعليًا، وكم تكلفته، ولماذا يمثل لحظة فارقة في المنافسة المستمرة بين الصين والولايات المتحدة في مجال الذكاء الاصطناعي.
سجل 'كيمي K3' درجة 57.1 على مؤشر الذكاء الاصطناعي المستقل Artificial Analysis Intelligence Index v4.1، مما وضعه في المركز الثالث عالميًا خلف Claude Fable 5 (60) وGPT-5.6 Sol (59) . الفجوة حوالي 3 نقاط فقط - ضيقة بالمعايير التاريخية - لكنها واضحة: اختبار الذكاء الأوسع لا يزال لصالح أفضل النماذج الأمريكية
. اعترفت Moonshot نفسها بذلك، قائلة علنًا إن K3 'لا يزال متأخرًا عن أقوى النماذج المملوكة' من Anthropic وOpenAI في الأداء الكلي
.
المجال الذي يتفوق فيه K3 هو المعايير البرمجية الواقعية (Agentic Benchmarks) المحددة:
| المعيار | Kimi K3 | Claude Fable 5 | GPT-5.6 Sol | Claude Opus 4.8 |
|---|---|---|---|---|
| Terminal-Bench 2.1 | 88.3 | 84.6 | 88.8 | 84.6 |
| DeepSWE | 73.0 | 70.0 | 67.5 | 59.0 |
| BrowseComp | 91.2 | 88.0 | 90.4 | 84.3 |
| Automation Bench | 75.6 | — | — | — |
| SpreadsheetBench 2 | 34.8 | 34.7 | 32.4 | 31.6 |
في هذه المعايير الخمسة بالإضافة إلى Program Bench (77.8)، فاز K3 بـ 5 من أصل 6، متغلبًا على كل من Fable 5 وGPT-5.6 Sol في تلك الاختبارات المحددة . كما تفوق بشكل كبير على Claude Opus 4.8 في كل معيار منشور - وهي نتيجة مهمة لأن Opus 4.8 مسعّر بـ 5 دولارات إدخال و 25 دولارًا إخراج لكل مليون رمز، مما يجعله منافسًا مباشرًا من حيث التكلفة
.
على منصة Arena، التي طورها باحثون من جامعة كاليفورنيا في بيركلي لقياس تفضيلات البشر العمياء، تصدر K3 لوحة صدارة البرمجة بعد إطلاقه بفترة وجيزة . أظهرت تقييمات المقارنة الجماعية على Arena أن K3 احتل المركز الأول في تطوير الويب للواجهة الأمامية (Front-End Web Development) بدرجة 1,679، متقدمًا على Fable 5 (1,631) وGPT-5.6 Sol (1,618)
.
في مجال تحسين نواة معالجات الرسوم (GPU Kernel Optimisation)، الذي يحسن كيفية تفاعل نماذج الذكاء الاصطناعي مع العتاد، ذكرت Moonshot أن K3 'تفوق بشكل جوهري' على Opus 4.8 وGPT-5.6 Sol وGPT-5.5 . هذا مهم تجاريًا لأن تحسين النواة يعني زمن استجابة أقل وإنتاجية أعلى على نفس العتاد.
يستخدم النموذج بنية MoE متفرقة مع 896 خبيرًا، يتم تنشيط 16 منهم فقط لكل رمز (token)، مما يجعله مشابهًا تقريبًا لتكلفة استدلال GPT-5.6 Sol على الرغم من حجمه البالغ 2.8 تريليون معلمة . كما يقدم Kimi Delta Attention (KDA) و Attention Residuals (AttnRes) - مكونات معمارية جديدة مصممة لتحسين الاستدلال طويل السياق
.
أحد أكثر الجوانب المربكة للسوق في كيمي K3 هو تسعير واجهة برمجة التطبيقات (API)، الذي يقل بشكل كبير عن أفضل النماذج الأمريكية:
| النموذج | الإدخال (لكل 1 مليون رمز) | الإخراج (لكل 1 مليون رمز) |
|---|---|---|
| Kimi K3 | 3.00 دولار | 15.00 دولار |
| GPT-5.6 Sol | 5.00 دولار | 30.00 دولار |
| Claude Fable 5 | 10.00 دولار | 50.00 دولار |
| Claude Opus 4.8 | 5.00 دولار | 25.00 دولار |
تكلفة Kimi K3 أقل بنسبة ~40% من GPT-5.6 Sol و أقل بنسبة ~70% من Claude Fable 5 وفقًا للأسعار الرسمية . النماذج الثلاثة تشكل سلمًا واضحًا بعامل 3.3x: Fable 5 يكلف 3.3 أضعاف Kimi K3 لكل من الإدخال والإخراج، مع GPT-5.6 Sol في المنتصف تقريبًا
.
بالإضافة إلى ذلك، يتمتع K3 بمعدل إدخال للذاكرة المخبأة (cache-hit) بقيمة 0.30 دولار لكل مليون رمز - أرخص بـ 10 مرات من معدله العادي - للاستعلامات التي تم تقديمها مسبقًا . على أساس كل مهمة، تقدر تكلفة K3 بـ 50-65% أقل من النماذج الأمريكية الرائدة
.
يمثل تسعير Moonshot لـ K3 تحولًا ملحوظًا: الآن أصبح مسعرًا كنموذج متطور بدلاً من خيار اقتصادي . كانت نماذج Kimi السابقة مثل K2.5 وK2.6 مسعرة بـ 0.60 دولار إدخال / 2.50-4.00 دولار إخراج، مما يجعل K3 أغلى بـ 3-4 مرات من أسلافه
. ومع ذلك، يظل أرخص من النماذج الأمريكية عالية المستوى مع تقديم أداء مماثل أو أفضل في المهام البرمجية المحددة.
في 19 يوليو 2026 - بعد حوالي 48 ساعة من الإطلاق - أعلنت Moonshot AI أنها توقف الاشتراكات الجديدة مؤقتًا لـ Kimi K3. نشرت الشركة على منصة X: "تلقى Kimi K3 حبًا أكثر بكثير مما توقعنا، ومعالجات الرسوم لدينا تشعر بذلك. خلال الـ 48 ساعة الماضية، اقترب الطلب من حدود طاقتنا الحالية" .
وقالت الشركة إنها ستعطي الأولوية للقدرة الحاسوبية للمشتركين الحاليين مع إضافة سعة في أسرع وقت ممكن، وتخطط لإعادة فتح أماكن الاشتراك على دفعات . احتفظ المستخدمون الحاليون بإمكانية الوصول الكامل، واستمرت خدمات المؤسسات وAPI
.
أشارت عدة وسائل إعلام إلى أن هذا الحادث يسلط الضوء على القيود المستمرة التي تواجهها الصين في مجال القدرات الحاسوبية بسبب القيود الأمريكية على تصدير الرقائق . كتبت صحيفة 'ساوث تشاينا مورنينج بوست' أن الموقف "يؤكد التحديات التي تواجهها مختبرات الذكاء الاصطناعي الصينية في تقديم منتجاتها للمستخدمين العالميين"
. لم تكن الأوزان الكاملة للنموذج، التي تسمح لأطراف ثالثة بتشغيله على أجهزتها الخاصة، متاحة حتى 27 يوليو - مما ترك Moonshot المزود الوحيد لقدرات الاستدلال خلال فترة الإطلاق
.
استغلت Moonshot فترة التوقف لتقسيم عضويتها إلى خطتين: Kimi Membership (للويب والتطبيق والعمل) و Kimi Code Membership (لسير عمل البرمجة)، وهو إعادة هيكلة مصممة لتخصيص الموارد الحاسوبية بشكل أفضل .
كان لإطلاق Kimi K3 تأثيرات متتالية تتجاوز معايير الذكاء الاصطناعي. ذكرت صحيفة 'ستريتس تايمز' مباشرة أن K3 "غذى موجة انهيار تقني"، وربطت عدة منافذ الإطلاق بعمليات بيع في أسهم أشباه الموصلات والذكاء الاصطناعي الأمريكية .
على صعيد الشركة، ذكرت وكالة 'رويترز' في 20 يوليو 2026 أن وقف الاشتراكات "يأتي في وقت تسعى فيه الشركة لجمع تمويل جديد، حيث تشير المصادر إلى أنها تتجه نحو طرح عام أولي في هونغ كونغ" .
من المقرر إصدار الأوزان الكاملة لنموذج Kimi K3 للجمهور في 27 يوليو 2026 . هذه تفاصيل حاسمة لأنها تعني أن المطورين والمؤسسات سيتمكنون في النهاية من تنزيل النموذج وتشغيله وفحصه وضبطه وامتلاكه بدلاً من مجرد استئجاره عبر API
. إن الإطلاق على مرحلتين - API أولاً، ثم الأوزان المفتوحة بعد أحد عشر يومًا - هو شكل الإعلان بأكمله
.
قبل إصدار الأوزان المفتوحة، يمكن للمطورين الوصول إلى K3 عبر kimi.com أو Kimi API أو OpenRouter . يتحدث النموذج لغة OpenAI SDK، ويدعم استدعاء الأدوات، والإخراج المنظم، والتخزين المؤقت التلقائي للسياق، وله نافذة سياق تبلغ مليون رمز بدون رسوم إضافية للسياق الطويل
.
ومع ذلك، فإن تشغيل نموذج بـ 2.8 تريليون معلمة محليًا ليس بالأمر السهل. يقدر حجم الملف بحوالي 1.5 تيرابايت، والأجهزة الموصى بها تشمل 64+ من معالجات NVIDIA H100 المخصصة للمؤسسات . بالنسبة لمعظم الفرق، سيبقى API نقطة الوصول العملية.
كيمي K3 ليس النموذج الذي يخلع GPT-5.6 Sol أو Claude Fable 5 من عرش الذكاء الكلي - Moonshot نفسها تقول ذلك. لكنه النموذج الذي يثبت أن نظامًا مفتوح الأوزان يمكنه منافسة النماذج المملوكة المتطورة في مهام محددة ذات قيمة تجارية، بتكلفة أقل بكثير. إنه أكبر نموذج مفتوح الأوزان يتم إطلاقه على الإطلاق، وقد وصل مع طلب حقيقي كافٍ لتعطيل بنية الشركة التحتية من معالجات الرسوم في غضون يومين.
هذا المزيج - أداء على مستوى متطور في المعايير البرمجية، وتسعير هجومي، وأوزان مفتوحة، وإشارة واضحة للطلب - يجعل K3 علامة فارقة مهمة في مشهد الذكاء الاصطناعي، بغض النظر عن مكانه على أي لوحة صدارة واحدة.