حقق محرك Kog AI أكثر من 3000 رمز مخرج في الثانية لكل طلب على عقدة واحدة من 8 معالجات AMD MI300X أسرع بنحو 30 مرة من السرعة النموذجية (100 300 رمز/ثانية) وذلك بدمج دورة فك التشفير بأكملها في برنامج GPU واحد ومستمر دون... الإصدار التجريبي التقني (مايو 2026) اقتصر على نموذج صغير (2.3 مليار معامل) ونوعين فقط من GPU (AMD...
إجابة البحث

Create a landscape editorial hero image for this Studio Global article: What is Kog, how does its approach to GPU inference acceleration differ from the hardware-centric strategy of companies like Cerebras, what. Article summary: Here is a comprehensive breakdown of Kog, covering all the areas you asked about.. Topic tags: general, general web, user generated, academic, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factua
أنفقت صناعة الذكاء الاصطناعي مليارات الدولارات في سباق تطوير رقائق أسرع. لكن شركة Kog AI الناشئة ومقرها باريس تراهن على أن المشكلة الحقيقية كانت مختلفة تماماً — ويشير إصدارها التجريبي التقني في مايو 2026 إلى أن هذا الرهان قد يكون صائباً.
Kog (Kog AI) هي شركة فرنسية ناشئة في البنية التحتية للذكاء الاصطناعي، تأسست في عام 2023 على يد غايل ديلالو. منتجها الأساسي هو محرك Kog للاستدلال (KIE)، وهو محرك استدلال برمجي بحت يُسرّع بشكل كبير استدلال نماذج اللغة الكبيرة على معالجات GPU القياسية في مراكز البيانات — دون الحاجة إلى رقائق مخصصة . خرجت الشركة من وضع التخفي في مايو 2025 وأطلقت إصداراً تجريبياً تقنياً عاماً في 28 مايو 2026
.
تشرع Cerebras في بناء رقائق بحجم الرقاقة بالكامل. تتبع Groq وSambaNova نهجاً مماثلاً يركز على الأجهزة. تراهن Kog على العكس: هناك فجوة هائلة في أداء معالجات GPU الحالية تتركها مكدسات البرامج غير الفعالة، ويمكن للتحسين البرمجي العميق على مستوى القواعد أن يضاهي أو يتجاوز سرعات الأجهزة المخصصة دون أي رقائق جديدة .
الابتكار الأساسي هو النواة الأحادية (monokernel) — برنامج واحد ومستمر مقيم على GPU يدير عملية فك التشفير الكاملة لنموذج اللغة الكبير (مرحلة ما قبل التعبئة، فك التشفير، وأخذ عينات الرأس) في جولة واحدة، مما يلغي عبء تشغيل النواة لكل رمز الذي يعيق المكدسات القياسية . أطر العمل القياسية مثل vLLM وSGLang وTensorRT-LLM تُشغل نواة GPU واحدة لكل رمز، وتدفع كل منها حوالي 4.5 ميكروثانية من الحمل الإضافي لإطلاقها بالإضافة إلى تأخير إعادة تشغيل HBM
. يتجاوز محرك Kog مكتبات الاتصالات القياسية ويلغي عمليات المزامنة الشبكية التي وجد أنها تستهلك 35٪ من وقت توليد كل رمز
.
يتم معايرة ادعاء "أسرع بـ30 مرة" مقابل سرعات فك التشفير النموذجية التي تتراوح بين 100 و300 رمز في الثانية للنماذج ذات 2 إلى 8 مليارات معامل على معالجات GPU عالية الجودة، مقارنة بـ 3000 رمز/ثانية من Kog .
النتائج:
القيود:
تستهدف Kog ثلاثة سيناريوهات رئيسية:
على الصعيد التجاري، أعلنت Kog عن أكثر من 200 عميل محتمل ملموس بحلول أغسطس 2026، وفقاً للرئيس التنفيذي ديلالو . وصل الإصدار التجريبي التقني إلى الصفحة الأولى لموقع Hacker News في مايو 2026
. حصلت الشركة على تمويل أولي بقيادة مشتركة من Varsity VC، حيث كان شريكها كامل زروال المؤسس المشارك لديلالو في شركته الناشئة الأولى، Stribe
.
يجلب الرئيس التنفيذي غايل ديلالو خلفية غير معتادة إلى البنية التحتية للذكاء الاصطناعي: فيزياء الحالة الصلبة والأمن السيبراني الهجومي .
تواجه Kog ثلاثة عقبات كبيرة في التوسع:
المحطة الفاصلة الحاسمة التالية لـ Kog هي إثبات فعالية نهجها على نماذج اللغة الكبيرة (70 مليار معامل أو أكثر). صرح الرئيس التنفيذي ديلالو أن الشركة تركز الآن على توسيع نطاق تقنياتها لتشمل نماذج اللغة الكبيرة بالحجم الكامل. تأتي الثقة من بنى GPU الأحدث ذات عرض نطاق ترددي أعلى للذاكرة بشكل كبير — وهو مورد تعتقد Kog أنه لا يزال غير مستغل بشكل كافٍ من قبل مكدسات البرامج القياسية . لم تعلن الشركة عن تاريخ محدد، لكن هذا العرض يُنظر إليه على نطاق واسع على أنه نقطة الإثبات الحاسمة للفلسفة بأكملها.
Studio Global AI
تتضمن هذه الصفحة إجابة مدعومة بالمصدر يمكنك المتابعة داخل Studio Global.
حقق محرك Kog AI أكثر من 3000 رمز مخرج في الثانية لكل طلب على عقدة واحدة من 8 معالجات AMD MI300X أسرع بنحو 30 مرة من السرعة النموذجية (100 300 رمز/ثانية) وذلك بدمج دورة فك التشفير بأكملها في برنامج GPU واحد ومستمر دون...
حقق محرك Kog AI أكثر من 3000 رمز مخرج في الثانية لكل طلب على عقدة واحدة من 8 معالجات AMD MI300X أسرع بنحو 30 مرة من السرعة النموذجية (100 300 رمز/ثانية) وذلك بدمج دورة فك التشفير بأكملها في برنامج GPU واحد ومستمر دون... الإصدار التجريبي التقني (مايو 2026) اقتصر على نموذج صغير (2.3 مليار معامل) ونوعين فقط من GPU (AMD MI300X وNVIDIA H200)، ولم يختبر الأداء تحت الأحمال المتزامنة أو عدة مستخدمين.
تستهدف Kog سير عمل الذكاء الاصطناعي الوكيل (Agentic AI) والاستدلال الفوري، وقد تلقت أكثر من 200 عميل محتمل بعد الإصدار التجريبي، مع تمويل أولي من Varsity VC.