Perplexity AI की सटीकता कार्य पर निर्भर करती है: SimpleQA जैसे फ़ैक्ट आधारित बेंचमार्क में यह 93.9% स्कोर करता है, लेकिन न्यूज़गार्ड की स्वतंत्र जाँच में पाया गया कि यह 35% मामलों में गलत ख़बरें दोहराता है [14]। वैज्ञानिक शोध प्रश्नों पर 97.2% और शैक्षणिक सामग्री पर 95% सटीकता के साथ, यह संरचित और स्रोत आधारित सवालो...
प्रकाशितकर्ताDeepSeek-V4-Flash से संपादितGPT Image 1.5 से चित्र बनाए गए
शोध उत्तर

Create a landscape editorial hero image for this Studio Global article: Searching with cited sources for How reliable is Perplexity AI?. Article summary: Perplexity AI's reliability varies notably by use case and metric. On standard factual benchmarks it scores in the low-to-mid 90% range, but independent audits show it still gets news facts wrong roughly one-third of the. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it
अगर आप पूछें कि Perplexity AI कितना सटीक है, तो आपको 93.9%, 94%, 65%, 78% जैसे कई अलग-अलग आंकड़े मिलेंगे। ये सभी अपने-अपने संदर्भ में सही हैं, लेकिन कोई भी पूरी कहानी नहीं बताता। Perplexity AI की परफॉरमेंस इस बात पर निर्भर करती है कि आप क्या पूछ रहे हैं, जानकारी कहाँ से आ रही है, और आप सटीकता को कैसे माप रहे हैं। सामान्य तथ्यात्मक सवालों के लिए यह सबसे अच्छे AI सर्च टूल्स में से एक है। लेकिन ब्रेकिंग न्यूज़, संवेदनशील दावों या गहन अकादमिक शोध के लिए इसके आउटपुट की सावधानीपूर्वक जाँच ज़रूरी है। यह लेख स्वतंत्र बेंचमार्क, ऑडिट और व्यावहारिक परीक्षणों के आधार पर Perplexity की वास्तविक विश्वसनीयता को तोड़कर बताता है, ताकि आप जान सकें कि कहाँ भरोसा करना है और कहाँ दोबारा जाँच करनी है।
मानक तथ्यात्मक बेंचमार्क पर Perplexity प्रतिस्पर्धी स्कोर हासिल करता है। SimpleQA पर इसका स्कोर 93.9% है, जो छोटे तथ्यात्मक सवालों के जवाब देने की क्षमता को मापता है और यह कई सामान्य प्रयोजन वाले LLMs से बेहतर है ।
AI Business Weekly के स्वतंत्र मूल्यांकन में 94% की समग्र तथ्यात्मक सटीकता रिपोर्ट की गई है, जो प्रश्न के प्रकार के अनुसार बदलती है :
पेशेवर बेंचमार्क परीक्षण में, जिसमें नीति विश्लेषण, तकनीकी समस्या समाधान और कंपनी शोध जैसे कार्य-संबंधित प्रश्न शामिल थे, Perplexity ने 92% तथ्यात्मक सटीकता हासिल की, जो उसी परीक्षण में ChatGPT के 87% से बेहतर है ।
Perplexity के अपने DRACO बेंचमार्क (जून 2026) के अनुसार, इसका डीप रिसर्च मॉडल Google DeepMind के DeepSearchQA और Scale AI के ResearchRubrics सहित बाहरी बेंचमार्क पर अत्याधुनिक परिणाम प्राप्त करता है ।
बेंचमार्क स्कोर एक कहानी बताते हैं, लेकिन वास्तविक दुनिया की खबरों की सटीकता दूसरी कहानी कहती है। सितंबर 2025 में NewsGuard द्वारा किए गए एक ऑडिट में पाया गया कि AI चैटबॉट अगस्त 2025 में 35% मामलों में गलत खबरों को दोहरा रहे थे — जो एक साल पहले 18% था । Perplexity को परीक्षण किए गए शीर्ष चैटबॉट्स में सबसे खराब गिरावट वाला बताया गया। 2024 के परीक्षण में Perplexity की सफलता दर शत-प्रतिशत थी; 2025 में यह लगभग आधे प्रयासों में सही जवाब देने में विफल रहा ।
TruthSignal, एक स्वतंत्र विश्वसनीयता ट्रैकर, @AskPerplexity की औसत विश्वसनीयता 65% आंकता है और इसे "सामान्य प्रश्नों और खोजपूर्ण शोध के लिए एक विश्वसनीय उपकरण" बताता है, लेकिन "तथ्य-जाँच या संवेदनशील विषयों के लिए इसकी विश्वसनीयता विवादित है" ।
बेंचमार्क स्कोर और वास्तविक दुनिया के प्रदर्शन के बीच का यह अंतर महत्वपूर्ण है। बेंचमार्क स्थिर, अच्छी तरह से सोर्स किए गए तथ्यों का परीक्षण करते हैं। ब्रेकिंग न्यूज़ में तेज़ी से बदलती कहानियाँ, परस्पर विरोधी स्रोत और ऐसी जानकारी शामिल होती है जो अभी तक ओपन वेब पर आधिकारिक नहीं हो सकती — ठीक वही स्थितियाँ जहाँ AI सर्च टूल्स को सबसे अधिक कठिनाई होती है।
Perplexity का मुख्य विक्रय बिंदु इसके उद्धरण (citations) हैं। हर जवाब क्रमांकित स्रोतों से जुड़ता है — लेकिन ये उद्धरण स्वयं कितने विश्वसनीय हैं?
फरवरी से मार्च 2026 तक किए गए एक व्यावहारिक परीक्षण में, एक समीक्षक ने 847 Pro Search क्वेरीज़ में 200 उद्धरणों की स्पॉट-चेकिंग की और पाया कि 78% सटीक थे । इसका मतलब है कि लगभग हर 5 में से 1 उद्धरण ऐसे स्रोत की ओर ले जाता है जो वास्तव में दावे का समर्थन नहीं करता।
अन्य समीक्षक ध्यान देते हैं कि उद्धरणों की गुणवत्ता व्यापक रूप से भिन्न होती है। ब्लॉग पोस्ट और कम आधिकारिक स्रोत कभी-कभी अकादमिक पेपर या आधिकारिक दस्तावेज़ों के साथ दिखाई देते हैं । कुछ उद्धरण पूरी तरह से काल्पनिक (hallucinated) होते हैं — गैर-मौजूद या अप्रासंगिक पृष्ठों से लिंक करते हैं ।
शैक्षणिक शोध के लिए विशेष रूप से, टो सेंटर के एक अध्ययन में पाया गया कि परीक्षण किए गए AI सर्च इंजनों में Perplexity में गलत उद्धरणों की दर सबसे कम थी, फिर भी यह लगभग 37% मामलों में गलत उत्तर देता था — यानी तीन में से एक से अधिक आउटपुट में त्रुटियाँ या गलत स्रोत थे ।
स्वतंत्र समीक्षाएँ Perplexity की ताकत और कमज़ोरी पर एकमत हैं :
सबसे मजबूत:
सबसे कमज़ोर:
"95%" जैसे आंकड़े ऑनलाइन बार-बार दोहराए जाने के बावजूद, Perplexity ने सभी उत्तर प्रकारों को कवर करने वाला कोई सार्वभौमिक, स्वतंत्र रूप से ऑडिट किया गया मूल्यांकन प्रकाशित नहीं किया है । इसका मापा गया प्रदर्शन बेंचमार्क, उत्पाद मोड, भाषा मॉडल, सूचना स्रोत, प्रश्न प्रकार और सटीकता की परिभाषा के अनुसार बदलता है ।
सबसे उपयोगी सारांश सभी डेटा को मिलाकर बनता है: सत्यापन योग्य स्रोतों के साथ सामान्य तथ्यात्मक शोध के लिए — विशेष रूप से करंट अफेयर्स, विज्ञान, तकनीक और संरचित विषयों पर — Perplexity सबसे विश्वसनीय AI टूल्स में से एक है। इसका उद्धरण मॉडल मौलिक रूप से बदलता है कि आप जानकारी कैसे सत्यापित करते हैं, और इसके बेंचमार्क स्कोर वास्तव में मजबूत हैं। लेकिन खबरों, संवेदनशील दावों और अकादमिक कार्यों के लिए, इसके आउटपुट को एक अंतिम उत्तर नहीं, बल्कि एक शुरुआती बिंदु मानें। महत्वपूर्ण तथ्यों की मैन्युअल रूप से जाँच करें, खासकर जब जानकारी तेज़ी से बदल रही हो या जोखिम अधिक हो।
Studio Global AI
इस पृष्ठ में एक स्रोत-समर्थित उत्तर शामिल है जिसे आप Studio Global के अंदर जारी रख सकते हैं।
Perplexity AI की सटीकता कार्य पर निर्भर करती है: SimpleQA जैसे फ़ैक्ट आधारित बेंचमार्क में यह 93.9% स्कोर करता है, लेकिन न्यूज़गार्ड की स्वतंत्र जाँच में पाया गया कि यह 35% मामलों में गलत ख़बरें दोहराता है [14]।
Perplexity AI की सटीकता कार्य पर निर्भर करती है: SimpleQA जैसे फ़ैक्ट आधारित बेंचमार्क में यह 93.9% स्कोर करता है, लेकिन न्यूज़गार्ड की स्वतंत्र जाँच में पाया गया कि यह 35% मामलों में गलत ख़बरें दोहराता है [14]। वैज्ञानिक शोध प्रश्नों पर 97.2% और शैक्षणिक सामग्री पर 95% सटीकता के साथ, यह संरचित और स्रोत आधारित सवालों में बेहतरीन है [10]।
उद्धरणों (citations) की विश्वसनीयता 78% पाई गई है, यानी लगभग हर पाँच में से एक उद्धरण गलत हो सकता है [13]।