Perplexity AI تحقق 93.9% في اختبار SimpleQA للمعلومات العامة و94% دقة إجمالية، لكن تقارير مستقلة كشفت أنها تكرر ادعاءات أخبارية خاطئة بنسبة 35% في أغسطس 2025، مع تراجع حاد عن العام السابق. دقة الاستشهادات تبلغ 78% فقط وفقًا لاختبار عملي، مما يعني أن واحدًا من كل خمسة مراجع قد لا يدعم المعلومة المذكورة فعليًا.
نشر بواسطةتم التحرير باستخدام DeepSeek-V4-Flashتم إنشاء الصور باستخدام GPT Image 1.5
إجابة البحث

Create a landscape editorial hero image for this Studio Global article: Searching with cited sources for How reliable is Perplexity AI?. Article summary: Perplexity AI's reliability varies notably by use case and metric. On standard factual benchmarks it scores in the low-to-mid 90% range, but independent audits show it still gets news facts wrong roughly one-third of the. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it
عندما تسأل عن دقة Perplexity AI، ستحصل على مزيج محير من الأرقام: 93.9%، 94%، 65%، 78%. ليست أيًا منها خاطئة، لكن لا أحد منها يروي القصة كاملة. أداء Perplexity AI يختلف بشكل كبير اعتمادًا على ما تسأل عنه، ومصدر المعلومة، وكيفية قياس الدقة. بالنسبة للأسئلة الواقعية العامة، فهي من بين أفضل أدوات البحث بالذكاء الاصطناعي المتاحة. أما بالنسبة للأخبار العاجلة والادعاءات الحساسة والأبحاث الأكاديمية العميقة، فمخرجاتها تحتاج إلى تحقق دقيق. هذا المقال يحلل بيانات الموثوقية الحقيقية من اختبارات وتدقيقات واختبارات عملية مستقلة، لتحدد متى تثق Perplexity ومتى تحتاج للتحقق.
على الاختبارات المعيارية الموحدة، تسجل Perplexity نتائج تنافسية. تحقق المنصة 93.9% في اختبار SimpleQA، وهو معيار مصمم لاختبار الإجابات الواقعية القصيرة، متجاوزة عدة نماذج لغة عامة . هذا ليس رقمًا منتقى بعناية: SimpleQA هو معيار صناعي مرموق، وهذه النتيجة هي أقوى نتيجة رسمية معلنة من Perplexity .
التقييمات المستقلة من AI Business Weekly تذكر دقة واقعية إجمالية تبلغ 94%، مع اختلاف الدقة حسب نوع الاستعلام :
في اختبارات مهنية معيارية مركزة على الاستعلامات المتعلقة بالعمل (تغطي تحليل السياسات، واستكشاف المشكلات التقنية، وأبحاث الشركات، والمزيد)، حققت Perplexity دقة واقعية 92%، متقدمة على ChatGPT الذي سجل 87% في نفس الاختبارات .
معيار DRACO الخاص بـ Perplexity (يونيو 2026) يُظهر أن نموذج Deep Research حقق نتائج متطورة على اختبارات خارجية بما فيها DeepSearchQA من Google DeepMind و ResearchRubrics من Scale AI .
نتائج الاختبارات المعيارية تحكي قصة واحدة. دقة الأخبار في العالم الحقيقي تحكي قصة أخرى. تدقيق أجرته NewsGuard في سبتمبر 2025 وجد أن روبوتات المحادثة بالذكاء الاصطناعي بشكل عام كررت ادعاءات إخبارية خاطئة بنسبة 35% في أغسطس 2025 – ارتفاعًا من 18% في العام السابق . تم تسليط الضوء على Perplexity كأكثر الأدوات تدهورًا بين أفضل روبوتات المحادثة التي تم اختبارها. في اختبار NewsGuard لعام 2024، كان أداء Perplexity مثاليًا؛ في عام 2025، فشلت في تقديم إجابات صحيحة في ما يقرب من نصف المحاولات .
TruthSignal، وهو متتبع موثوقية مستقل، يصنف متوسط مصداقية @AskPerplexity عند 65%، واصفًا إياها بـ "أداة موثوقة للاستفسارات العامة والأبحاث الاستكشافية"، لكنه يشير إلى أن موثوقيتها "للتحقق من الحقائق أو المواضيع الحساسة موضع خلاف" .
هذه الفجوة بين نتائج الاختبارات المعيارية والأداء الواقعي مهمة. تختبر المعايير حقائق ثابتة ذات مصادر جيدة. الأخبار العاجلة تنطوي على روايات متغيرة بسرعة، ومصادر متضاربة، ومعلومات قد لا تكون موثوقة بعد على الويب المفتوح – وهي بالضبط الظروف التي تكافح فيها أدوات البحث بالذكاء الاصطناعي.
عرض القيمة الرئيسي لـ Perplexity هو الاستشهادات. كل إجابة تربط بمصادر مرقمة – لكن ما مدى موثوقية هذه الاستشهادات بأنفسهم؟
في اختبار عملي أجري من فبراير إلى مارس 2026، قام أحد المراجعين بالتحقق من 200 استشهاد عبر 847 استعلام بحث Pro ووجد أن 78% تم التحقق من دقتها . هذا يعني أن واحدًا من كل 5 استشهادات تقريبًا يقود إلى مصدر لا يدعم الادعاء المذكور فعليًا.
مراجعون آخرون يلاحظون أن جودة الاستشهادات تختلف بشكل كبير. تظهر منشورات المدونات والمصادر الأقل موثوقية أحيانًا بجانب الأوراق الأكاديمية أو الوثائق الرسمية . بعض الاستشهادات تكون مهلوسة بالفعل – حيث ترتبط بصفحات غير موجودة أو غير ذات صلة .
بالنسبة للبحث الأكاديمي على وجه التحديد، وجدت دراسة مركز Tow أن Perplexity لديها أدنى معدل من الاستشهادات غير الصحيحة بين محركات البحث بالذكاء الاصطناعي التي تم اختبارها، لكنها لا تزال تجيب بشكل غير صحيح في حوالي 37% من الحالات – مما يعني أن أكثر من واحد من كل ثلاثة مخرجات يحتوي على أخطاء أو ادعاءات مسندة بشكل خاطئ .
تتفق المراجعات المستقلة باستمرار على نقاط القوة والضعف في Perplexity :
الأقوى في:
الأضعف في:
على الرغم من تداول أرقام مثل "95%" بشكل متكرر عبر الإنترنت، لم تنشر Perplexity تقييمًا شاملاً مستقلاً يغطي جميع أنواع الإجابات . أداؤها المقاس يتغير اعتمادًا على الاختبار المعياري، ووضع المنتج، ونموذج اللغة، ومصدر المعلومات، ونوع السؤال، وكيفية تعريف الدقة .
الملخص الأكثر فائدة يأتي من دمج جميع البيانات: بالنسبة للبحث الواقعي العام بمصادر قابلة للتحقق – خاصة الأحداث الجارية، والعلوم، والتكنولوجيا، والموضوعات المنظمة – فإن Perplexity هي واحدة من أكثر أدوات الذكاء الاصطناعي موثوقية المتاحة. نموذج الاستشهادات الخاص بها يغير بشكل أساسي كيفية التحقق من المعلومات، ونتائج اختباراتها المعيارية قوية حقًا. لكن بالنسبة للأخبار والادعاءات الحساسة والعمل الأكاديمي، تعامل مع مخرجاتها كنقطة انطلاق، وليست إجابة نهائية. تحقق من الحقائق الهامة يدويًا، خاصة عندما تكون المعلومات سريعة التغير أو عندما تكون المخاطر عالية.
Studio Global AI
تتضمن هذه الصفحة إجابة مدعومة بالمصدر يمكنك المتابعة داخل Studio Global.
Perplexity AI تحقق 93.9% في اختبار SimpleQA للمعلومات العامة و94% دقة إجمالية، لكن تقارير مستقلة كشفت أنها تكرر ادعاءات أخبارية خاطئة بنسبة 35% في أغسطس 2025، مع تراجع حاد عن العام السابق.
Perplexity AI تحقق 93.9% في اختبار SimpleQA للمعلومات العامة و94% دقة إجمالية، لكن تقارير مستقلة كشفت أنها تكرر ادعاءات أخبارية خاطئة بنسبة 35% في أغسطس 2025، مع تراجع حاد عن العام السابق. دقة الاستشهادات تبلغ 78% فقط وفقًا لاختبار عملي، مما يعني أن واحدًا من كل خمسة مراجع قد لا يدعم المعلومة المذكورة فعليًا.
الأداة تتفوق في البحث العلمي (97.2% دقة) والمحتوى الأكاديمي (95%)، لكنها أضعف في الأخبار العاجلة والتفكير العميق والتحليل متعدد الخطوات، مما يجعلها أداة بحثية ممتازة لكنها ليست مصدرًا نهائيًا للمعلومات.