هجوم إعادة التشغيل 'الأفكار المسروقة' — نُشر في 10-11 أغسطس 2026 في ورقة بحثية بعنوان "سرقة مسارات التفكير من واجهات برمجة تطبيقات نماذج اللغات الكبيرة الخاصة" (arXiv:2608.09867). اكتشف الباحثون بانتيلوف وشموتز وشوميلوف وبورر-كلنر وشيفر وبرابهو وجيبينج وأندريوشنكو ثغرة معمارية خطيرة. 'كتل التفكير' المشفرة التي تعيدها Anthropic وOpenAI وGoogle إلى عملاء واجهة برمجة التطبيقات (API) ليست محكمة الإغلاق بشكل صحيح لمصدرها. يمكن رفع هذه الكتل من محادثة واحدة وإعادة تشغيلها في نموذج شقيق أضعف وأقل حراسة من نفس المزود، والذي يقوم بعد ذلك بطباعة التفكير المخفي للنموذج الرائد كنص واضح . يعمل الهجوم عبر الجلسات وعبر حسابات المستخدمين وعبر النماذج داخل النظام البيئي للمزود نفسه . أكد الباحثون أن التقنية تعمل على كل شركة رائدة في مجال الذكاء الاصطناعي اختبروها، وأن طول التفكير المستعاد يطابق عدد رموز التفكير المخفية التي أبلغت عنها واجهة برمجة التطبيقات (API) بنسبة 1:1 تقريبًا .
توفر مسارات التفكير المستخرجة إشارات تدريب عالية الجودة لـ تقطير النموذج — وهي ممارسة استخدام مخرجات نموذج أقوى لتدريب نموذج منافس أصغر وأرخص . هذه التقنية هي محور جدل حاد حول مختبرات الذكاء الاصطناعي الصينية:
ومع ذلك، فإن الأدلة ليست قاطعة. يجادل باحثون من بينهم برادن هانكوك (معهد لودي) وناثان لامبيرت (معهد ألين للذكاء الاصطناعي) بأن التقطير وحده لا يمكن أن يفسر القدرات الكاملة لـ Kimi K3. تم انتقاد ملف PDF منتشر على نطاق واسع يدعي دليلاً على تقطير سلسلة التفكير لدمجه تجربة محدودة مع ادعاءات غير مدعومة .
تقدم الثغرة مخاطر ملموسة متعددة تتجاوز سرقة الملكية الفكرية:
تم الاتصال بالشركات الثلاث من قبل باحثي 'الأفكار المسروقة' قبل النشر. وفقًا للتقارير، قامت OpenAI وAnthropic وGoogle بإغلاق هجوم التفكير عبر النماذج بعد إخطارها. لم يتم الكشف عن تفاصيل محددة حول إجراءات التخفيف الخاصة بهم بشكل كامل في المصادر المنشورة، ولكن تم تأكيد وجود الثغرة عبر جميع واجهات برمجة التطبيقات (APIs) للمزودين الثلاثة قبل التصحيح . كون الهجوم 'مغلقًا' يشير إلى أن الشركات نفذت إصلاحات من جانب الخادم — ربما تقييد إعادة استخدام كتل التفكير المشفرة عبر سياقات نماذج أو حسابات مختلفة .
كانت Anthropic بالفعل تحارب التقطير على نطاق واسع علنًا، وأبلغت عن 24,000 حساب احتيالي و 16 مليون تبادل استخدمتها المختبرات الصينية لاستخراج مخرجات Claude .
الدرس الأساسي من كل من ورقتي REP و 'الأفكار المسروقة' هو أن إخفاء أو تشفير مسارات التفكير هو استراتيجية أمنية هشة بشكل أساسي — إذا كان التفكير موجودًا في أوزان النموذج، فيمكن استثارته .