إنفيديا تدفع الذكاء الاصطناعي المحلي إلى ما بعد جهاز واحد
تريد إنفيديا جعل الذكاء الاصطناعي المحلي منظومة متكاملة: إعداد أسهل للوكلاء، واستدلال أسرع، والاستفادة من عدة أجهزة متوافقة داخل الشبكة المنزلية. PAIR أداة مجانية ومفتوحة المصدر توفر نقطة اتصال محلية واحدة وتوجّه طلبات Ollama وLM Studio المستقلة إلى الجهاز المؤهل والأقل انشغالاً.[3][10] لا يدمج PAIR ذواكر بطاقات الر...
نشر بواسطةتم التحرير باستخدام GPT-5.6 Terraتم إنشاء الصور باستخدام GPT Image 2
تريد إنفيديا جعل الذكاء الاصطناعي المحلي منظومة متكاملة: إعداد أسهل للوكلاء، واستدلال أسرع، والاستفادة من عدة أجهزة متوافقة داخل الشبكة المنزلية.
PAIR أداة مجانية ومفتوحة المصدر توفر نقطة اتصال محلية واحدة وتوجّه طلبات Ollama وLM Studio المستقلة إلى الجهاز المؤهل والأقل انشغالاً.[3][10]
لا يدمج PAIR ذواكر بطاقات الرسوميات أو يحوّل عدة حواسيب إلى معالج واحد؛ فائدته الأساسية هي رفع القدرة على تنفيذ الطلبات المتوازية وتقليل الانتظار.[1][2]
من المقرر وصول حواسيب Windows المزودة بـ RTX Spark في أكتوبر، مع خيارات تصل إلى 128 غيغابايت من الذاكرة الموحّدة وبيتا فلوب واحد من أداء الذكاء الاصطناعي.[25][40]
How did Nvidia’s IFA 2026 announcements advance its local-AI strategy, including the free open-source Personal AI Router (PAIR) tool that diNvidia’s IFA 2026 announcements link local inference routing, agent software, and new RTX Spark hardware.
موجّه الذكاء الاصطناعي
Create a landscape editorial hero image for this Studio Global article: How did Nvidia’s IFA 2026 announcements advance its local-AI strategy, including the free open-source Personal AI Router (PAIR) tool that di. Article summary: Nvidia’s IFA 2026 announcements turned its local-AI strategy into a fuller stack: simpler agent deployment, faster single-device inference, coordinated use of several household machines, and a new Windows hardware tier d. Topic tags: general, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
openai.com
لا تقتصر إعلانات إنفيديا في معرض IFA 2026 على تشغيل نموذج ذكاء اصطناعي من دون اتصال بالإنترنت. الفكرة الأوسع هي تخفيف التعقيد الذي يواجهه من يريد تشغيل وكلاء الذكاء الاصطناعي محلياً: إعداد أبسط، وأداء أفضل، وإمكانية توزيع المهام المتوازية على أجهزة متوافقة داخل المنزل، ثم فئة حواسيب جديدة ذات ذاكرة كبيرة للنماذج الأضخم. 1021
PAIR: شبكة المنزل تصبح مورداً للاستدلال
أبرز ما أعلنت عنه الشركة هو NVIDIA Personal AI Router (PAIR)، وهي أداة تجريبية مجانية ومفتوحة المصدر للاستدلال المحلي. تمنح التطبيقات أو الوكلاء عنواناً محلياً واحداً لإرسال الطلبات، ثم تختار PAIR الجهاز المقترن والمؤهل على الشبكة المحلية لتنفيذ كل طلب استدلال مستقل. وتدعم نقاط وسيطة متوافقة مع واجهات Ollama وOpenAI، ما يسمح باستمرار سير العمل القائم من دون إعادة بنائه حول إطار عمل جديد للوكلاء. 13
تستهدف الأداة تحديداً الحالات التي يقسّم فيها الوكيل مهمة كبيرة إلى مهام أصغر متزامنة، أو يفوض أجزاء منها إلى وكلاء فرعيين. بدلاً من وضع جميع الطلبات في طابور بطاقة رسوميات واحدة، تستطيع PAIR إرسال الطلبات المنفصلة إلى أجهزة يتوافر فيها المحرك والنموذج المطلوبان، مع مراعاة الحمل الحالي. وهي تعمل مع Ollama وLM Studio. 11011
ما الذي تفعله PAIR فعلاً؟
النقطة الأهم: PAIR هي موجّه للطلبات، وليست تقنية تجمع بطاقات الرسوميات المنزلية في معالج واحد ضخم. فكل طلب مستقل يُنفّذ على جهاز تختاره الأداة، وليس على مجموع الأجهزة في وقت واحد.
لذلك، الفائدة العملية هي تنفيذ عدد أكبر من الطلبات المتوازية وتخفيف وقت الانتظار في المهام القابلة للفصل. لكنها لن تجمع ذاكرة الفيديو في عدة حواسيب لتشغيل نموذج لا يتسع في ذاكرة أي جهاز منفرد. 123
تذكر إنفيديا دعماً لأجهزة Windows المزودة ببطاقات RTX المتوافقة، وأنظمة DGX Spark، وأجهزة macOS. وتشمل المتطلبات المنشورة بطاقات GeForce RTX من سلسلة 20 أو أحدث، وDGX Spark/GB10، وأجهزة Mac بمعالج M4 أو أحدث، إلى جانب متطلبات نظام التشغيل المعني. 8
وهذا يجعل الحاسوب المكتبي أو المحمول أو جهاز Mac المتوافق، إن كانت على الشبكة نفسها، مورداً إضافياً مفيداً للمهام المحلية المتوازية. كما تضع إنفيديا الخصوصية في صلب الفكرة، إذ تقول إن المطالبات والملفات وسياق الوكيل تبقى داخل شبكة المستخدم المنزلية. 48
إعداد الوكلاء المحليين يصبح أقل تعقيداً
أعلنت إنفيديا أيضاً عن مسارات أبسط لتشغيل Hermes Agent وOpenClaw وPerplexity Portable Computer على أجهزتها محلياً. وتعتمد تجارب Windows المعلنة على llama.cpp، مع دمج تحسينات إنفيديا للاستدلال، بهدف تقليل الحاجة إلى اختيار نموذج يدوياً، والعثور على خادم استدلال متوافق، وضبط الإعدادات بنفسك. 1521
وهذه نقطة مهمة لأن عقبة الذكاء الاصطناعي المحلي ليست القدرة الحاسوبية وحدها؛ فكثيراً ما تكون عملية التثبيت والتهيئة هي العائق الحقيقي. وتقول إنفيديا إن Hermes سيوفر نشرًا بنقرة واحدة على أنظمة RTX وDGX في Windows وLinux، بينما يعمل OpenClaw على تبسيط الإعداد على حواسيب Windows المزودة بعتاد RTX المدعوم. 21
تحسينات برمجية تدفع الاستدلال إلى الأمام
أعلنت الشركة كذلك عن تحسينات جديدة لـ llama.cpp وvLLM، وتقول إنها قد ترفع أداء الاستدلال المحلي بما يصل إلى 1.9 مرة. ووفقاً لإنفيديا، تتوفر البرمجيات المحدّثة مباشرةً ومن خلال LM Studio، فيما من المخطط إطلاق تحديث أداء لـ Ollama لاحقاً. 1021
لكن رقم 1.9 مرة هو حد أقصى معلن من الشركة ويتغير بحسب عبء العمل، وليس وعداً ثابتاً لكل نموذج أو بطاقة رسوميات. فالنتائج الواقعية تتأثر ببنية النموذج، وطريقة ضغطه، وطول المطالبة، والعتاد، ومدى قابلية المهمة للتوزيع إلى طلبات مستقلة. ومع ذلك، تكمن أهمية هذه الخطوة في وصول التحسينات إلى أدوات مفتوحة المصدر مألوفة، لا في فرض واجهة نماذج حصرية لإنفيديا. 1017
RTX Spark: فئة حواسيب بذاكرة أكبر للذكاء الاصطناعي المحلي
على مستوى العتاد، قالت إنفيديا إن حواسيب Windows المزودة بمنصة RTX Spark القائمة على منصة N1X بمعمارية Arm يُتوقع وصولها في أكتوبر. وتجمع أعلى مواصفات المنصة بين معالج Grace ذي 20 نواة ووحدة Blackwell RTX، مع ما يصل إلى 128 غيغابايت من الذاكرة الموحّدة وما يصل إلى بيتا فلوب واحد من أداء الذكاء الاصطناعي. 3440
وتكتسب الذاكرة الموحّدة أهمية خاصة هنا، لأن حجم النموذج وسياقه قد يتقيدان بسعة الذاكرة، لا بسرعة وحدة الرسوميات فقط. وتستهدف RTX Spark إنشاء فئة أعلى من حواسيب Windows لتشغيل الوكلاء وأعباء العمل الخاصة الأكبر محلياً، مع الاحتفاظ بقدرات الرسوميات التقليدية. وقالت إنفيديا إن شركاء، منهم Lenovo وAcer، سيطرحون تصاميم مبنية على RTX Spark. 253242
ما الاستراتيجية وراء هذه الإعلانات؟
تغطي حزمة IFA 2026 أربع عقبات رئيسية أمام انتشار الذكاء الاصطناعي المحلي:
الأداء: تحسينات llama.cpp وvLLM تستهدف تسريع الاستدلال على الجهاز الواحد. 1017
التوسع للمهام المتزامنة: تتيح PAIR استخدام الأجهزة المتوافقة غير المستغلة لتنفيذ طلبات محلية منفصلة. 13
التوسع للنماذج الأكبر: تقدم RTX Spark منصة Windows بذاكرة موحّدة أكبر بكثير من التكوينات الاستهلاكية المعتادة. 4042
مع ذلك، تحل هذه المكونات مشكلات مختلفة. PAIR مفيدة عندما يمكن فصل العمل إلى طلبات متوازية، لكنها لا تجعل نموذجاً أكبر من قدرة أي جهاز مشارك على استضافته. أما RTX Spark، فيمكن أن تعالج هذه المشكلة عبر تكوينات الذاكرة الكبيرة، لكنها عتاد جديد وليست ترقية مجانية للحواسيب القائمة. كما أن ادعاءات الأداء من إنفيديا تحتاج إلى اختبار على أعباء عمل إنتاجية متنوعة. 1240
الخلاصة: تحاول إنفيديا أن تجعل الذكاء الاصطناعي المحلي أقل شبهاً بمجموعة متفرقة من النماذج وأوامر الطرفية، وأكثر شبهاً بخيار حوسبة شخصية متكامل للوكلاء والمبدعين والمطورين الذين يريدون تحكماً أكبر في مكان تنفيذ أعمال الذكاء الاصطناعي. 1014
Studio Global AI
مواصلة البحث الخاص بك
تتضمن هذه الصفحة إجابة مدعومة بالمصدر يمكنك المتابعة داخل Studio Global.
ما هي الإجابة المختصرة على "إنفيديا تدفع الذكاء الاصطناعي المحلي إلى ما بعد جهاز واحد"؟
تريد إنفيديا جعل الذكاء الاصطناعي المحلي منظومة متكاملة: إعداد أسهل للوكلاء، واستدلال أسرع، والاستفادة من عدة أجهزة متوافقة داخل الشبكة المنزلية.
ما هي النقاط الأساسية التي يجب التحقق منها أولاً؟
تريد إنفيديا جعل الذكاء الاصطناعي المحلي منظومة متكاملة: إعداد أسهل للوكلاء، واستدلال أسرع، والاستفادة من عدة أجهزة متوافقة داخل الشبكة المنزلية. PAIR أداة مجانية ومفتوحة المصدر توفر نقطة اتصال محلية واحدة وتوجّه طلبات Ollama وLM Studio المستقلة إلى الجهاز المؤهل والأقل انشغالاً.[3][10]
ماذا يجب أن أفعل بعد ذلك في الممارسة العملية؟
لا يدمج PAIR ذواكر بطاقات الرسوميات أو يحوّل عدة حواسيب إلى معالج واحد؛ فائدته الأساسية هي رفع القدرة على تنفيذ الطلبات المتوازية وتقليل الانتظار.[1][2]