Perplexity scoort 93,9% op de SimpleQA benchmark en komt in andere evaluaties uit op ongeveer 94% feitelijke nauwkeurigheid [10][16]. Bij nieuws ligt de betrouwbaarheid lager: een NewsGuard audit stelde vast dat AI chatbots in 35% van de gevallen onjuiste nieuwsclaims herhaalden; Perplexity liet daarbij een sterke t...
Gepubliceerd doorBewerkt met DeepSeek-V4-FlashAfbeeldingen gegenereerd met GPT Image 1.5
Research answer

Create a landscape editorial hero image for this Studio Global article: Searching with cited sources for How reliable is Perplexity AI?. Article summary: Perplexity AI's reliability varies notably by use case and metric. On standard factual benchmarks it scores in the low-to-mid 90% range, but independent audits show it still gets news facts wrong roughly one-third of the. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it
Wie wil weten hoe nauwkeurig Perplexity AI is, krijgt al snel een verwarrend rijtje cijfers voorgeschoteld: 93,9%, 94%, 65% en 78%. Die percentages hoeven elkaar niet tegen te spreken. Ze meten alleen verschillende dingen, onder uiteenlopende omstandigheden.
Perplexity behoort voor algemene feitelijke vragen tot de sterkere AI-zoektools. Toch verandert de betrouwbaarheid aanzienlijk afhankelijk van het onderwerp, de gebruikte bronnen en de manier waarop je nauwkeurigheid definieert. Bij breaking news, gevoelige beweringen en diepgaand academisch onderzoek is extra controle dan ook geen overbodige luxe.
Op gestandaardiseerde benchmarks presteert Perplexity competitief. Het platform behaalt 93,9% op SimpleQA, een test voor korte feitelijke antwoorden. Daarmee verslaat het verschillende algemene taalmodellen . Dit is geen willekeurig percentage uit een marketingtekst: SimpleQA geldt als een bekende benchmark in de sector en is het sterkst officieel gerapporteerde resultaat dat aan Perplexity wordt gekoppeld .
Onafhankelijke evaluaties van AI Business Weekly melden daarnaast 94% algemene feitelijke nauwkeurigheid, met verschillen per type vraag :
In een professionele benchmark met werkgerelateerde vragen — waaronder beleidsanalyse, technische probleemoplossing en onderzoek naar bedrijven — kwam Perplexity uit op 92% feitelijke nauwkeurigheid. In dezelfde tests behaalde ChatGPT 87% .
Ook Perplexity's eigen DRACO-benchmark, gepubliceerd in juni 2026, meldt dat het Deep Research-model resultaten op topniveau behaalt op externe benchmarks zoals DeepSearchQA van Google DeepMind en ResearchRubrics van Scale AI . Omdat deze evaluatie door Perplexity zelf is gepubliceerd, is het verstandig die uitkomst naast onafhankelijke tests te leggen.
Benchmarkcijfers vertellen maar een deel van het verhaal. In de dagelijkse praktijk — en vooral bij nieuws — kan de prestatie sterk tegenvallen.
Een audit van NewsGuard uit september 2025 stelde vast dat AI-chatbots in augustus van dat jaar 35% van de tijd onjuiste nieuwsclaims herhaalden. Een jaar eerder was dat 18% . Perplexity werd genoemd als de chatbot met de grootste terugval onder de onderzochte grote chatbots. In de test van 2024 gaf het systeem nog foutloze antwoorden, terwijl het in 2025 bij bijna de helft van de pogingen geen correct antwoord gaf .
De onafhankelijke geloofwaardigheidstracker TruthSignal beoordeelt de gemiddelde geloofwaardigheid van @AskPerplexity op 65%. Volgens de tracker is Perplexity een bruikbaar hulpmiddel voor algemene vragen en verkennend onderzoek, maar staat de betrouwbaarheid bij factchecking en gevoelige onderwerpen ter discussie .
Dat verschil met de hoge benchmarkscores is belangrijk. Benchmarks testen meestal statische, goed afgebakende feiten. Breaking news draait juist om snel veranderende ontwikkelingen, tegenstrijdige bronnen en informatie waarvoor op het openbare web nog geen definitieve bevestiging bestaat. Dat zijn precies de omstandigheden waarin AI-zoektools sneller de mist in kunnen gaan.
Een van de grootste pluspunten van Perplexity zijn de genummerde bronvermeldingen onder elk antwoord. Daarmee kun je nagaan waar een bewering vandaan komt. Maar een link onder een antwoord betekent niet automatisch dat de bron de bewering volledig ondersteunt.
In een praktijktest van februari tot en met maart 2026 controleerde een beoordelaar 200 citaten uit 847 Pro Search-opdrachten. 78% van de citaten werd als correct geverifieerd . Anders gezegd: ongeveer één op de vijf gecontroleerde verwijzingen onderbouwde de bijbehorende bewering niet daadwerkelijk.
Andere reviewers merken op dat de kwaliteit van de bronnen sterk kan wisselen. Een antwoord kan academische publicaties of officiële documenten combineren met blogs en minder gezaghebbende websites . Ook zijn er meldingen van verzonnen citaten die naar niet-bestaande of niet-relevante pagina's verwijzen .
Voor academisch onderzoek is de lat vanzelfsprekend hoger. Een studie van het Tow Center concludeerde dat Perplexity van de geteste AI-zoekmachines het laagste aandeel onjuiste citaten had, maar nog altijd in ongeveer 37% van de gevallen een foutief antwoord gaf. Meer dan één op de drie uitkomsten bevatte dus fouten of verkeerd toegeschreven beweringen . Dat maakt controle noodzakelijk voordat je de informatie in een scriptie, publicatie of onderzoeksrapport gebruikt.
Onafhankelijke reviews wijzen grotendeels op hetzelfde profiel .
Perplexity is het sterkst bij:
Perplexity is minder sterk bij:
Het vaak genoemde cijfer van “95%” moet je niet opvatten als de algemene betrouwbaarheid van alle antwoorden. Perplexity heeft geen universele, onafhankelijk gecontroleerde evaluatie gepubliceerd die aantoont dat 95% van alle antwoorden, zoekopdrachten of citaten correct is . De uitkomst hangt af van de benchmark, de productmodus, het gekozen taalmodel, de beschikbare bronnen, het soort vraag en de definitie van nauwkeurigheid .
De meest eerlijke samenvatting van de beschikbare gegevens is daarom als volgt: voor algemene feitelijke research met controleerbare bronnen — vooral over wetenschap, technologie, gestructureerde onderwerpen en veel actuele ontwikkelingen — is Perplexity een van de betrouwbaardere AI-tools. De bronvermeldingen maken het bovendien makkelijker om beweringen te controleren dan bij een antwoord zonder verwijzingen.
Maar bij nieuws, gevoelige onderwerpen en academisch werk moet je het antwoord zien als een goed vertrekpunt, niet als het laatste woord. Open de aangehaalde bronnen, controleer of ze de claim echt ondersteunen en vergelijk belangrijke feiten met primaire of officiële bronnen. Zeker wanneer de informatie snel verandert of de gevolgen van een fout groot zijn, blijft menselijke verificatie noodzakelijk.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Perplexity scoort 93,9% op de SimpleQA benchmark en komt in andere evaluaties uit op ongeveer 94% feitelijke nauwkeurigheid [10][16].
Perplexity scoort 93,9% op de SimpleQA benchmark en komt in andere evaluaties uit op ongeveer 94% feitelijke nauwkeurigheid [10][16]. Bij nieuws ligt de betrouwbaarheid lager: een NewsGuard audit stelde vast dat AI chatbots in 35% van de gevallen onjuiste nieuwsclaims herhaalden; Perplexity liet daarbij een sterke terugval zien [14].
Bronvermeldingen zijn nuttig, maar niet foutloos: in een praktijktest werd 78% van de gecontroleerde citaten als correct beoordeeld [13].