Oberoende utvärderingar som återges av AI Business Weekly anger 94 procents övergripande faktisk korrekthet, med variationer mellan olika frågetyper :
I ett professionellt benchmarktest med arbetsrelaterade frågor – bland annat policyanalys, teknisk felsökning och företagsresearch – nådde Perplexity 92 procents faktisk korrekthet, jämfört med 87 procent för ChatGPT i samma test .
Perplexitys eget DRACO-test, som presenterades i juni 2026, uppger dessutom att företagets Deep Research-modell når resultat i toppklass i externa benchmarktester, däribland Google DeepMinds DeepSearchQA och Scale AI:s ResearchRubrics .
Benchmarkresultat berättar dock bara en del av historien. I verkliga nyhetsflöden kan resultatet se betydligt sämre ut.
En granskning från NewsGuard, som publicerades i september 2025, visade att AI-chattbotar sammantaget upprepade falska nyhetspåståenden 35 procent av gångerna under augusti samma år. Året före var motsvarande andel 18 procent . Perplexity pekades ut som tjänsten med den kraftigaste försämringen bland de större chattbotarna. I NewsGuards test från 2024 hade Perplexity klarat sig utan fel, medan tjänsten 2025 inte gav korrekta svar i närmare hälften av försöken .
Även TruthSignal, en oberoende tjänst som följer trovärdighet, ger @AskPerplexity ett genomsnittligt trovärdighetsbetyg på 65 procent. Bedömningen är att verktyget fungerar för allmänna frågor och inledande research, men att tillförlitligheten vid faktagranskning och känsliga ämnen är omdiskuterad .
Skillnaden mellan benchmarktester och nyhetsgranskningar är viktig. Benchmarktester använder ofta statiska och väl dokumenterade fakta. Breaking news präglas däremot av motstridiga uppgifter, snabbt föränderliga händelseförlopp och information som ännu inte hunnit bekräftas av auktoritativa källor. Det är just sådana förhållanden där AI-sökverktyg lättare får problem.
Perplexitys främsta försäljningsargument är att svaren förses med numrerade källhänvisningar. Det gör det lättare att kontrollera uppgifterna än i ett svar utan referenser. Men själva hänvisningarna måste också granskas.
I ett praktiskt test mellan februari och mars 2026 kontrollerade en recensent 200 hänvisningar från 847 Pro Search-frågor. 78 procent verifierades som korrekta . Det innebär att ungefär var femte kontrollerad hänvisning ledde till en källa som inte fullt ut stödde påståendet i svaret.
Andra granskningar visar att kvaliteten på källorna varierar. Blogginlägg och mindre auktoritativa sidor kan förekomma sida vid sida med akademiska artiklar och officiella dokument . I vissa fall har användare och recensenter också rapporterat hänvisningar som varit påhittade eller lett till irrelevanta sidor .
För akademisk research är kraven särskilt höga. En studie från Tow Center visade att Perplexity hade den lägsta andelen felaktiga hänvisningar bland de AI-sökmotorer som testades. Samtidigt blev ungefär 37 procent av svaren felaktiga eller innehöll felaktigt tillskrivna påståenden . Det är för mycket för att materialet ska kunna användas okritiskt i en uppsats eller vetenskaplig text.
Oberoende recensioner pekar i stort sett på samma styrkor och svagheter .
Perplexity är starkast för:
Var mer försiktig med:
Siffror som ”95 procent korrekt” sprids ofta på nätet, men Perplexity har inte publicerat någon universell, oberoende och heltäckande granskning som visar att 95 procent av alla svar, sökningar eller hänvisningar är korrekta . Resultaten varierar beroende på benchmark, produktläge, vald språkmodell, informationskälla, frågetyp och vad som räknas som korrekt .
Den mest rättvisa sammanfattningen är därför nyanserad: För allmän faktaresearch med kontrollerbara källor – särskilt inom vetenskap, teknik, strukturerade ämnen och många aktuella frågor – är Perplexity ett av de mer tillförlitliga AI-verktygen. Källhänvisningarna gör det enklare att upptäcka fel och följa upp informationen, och benchmarkresultaten är genuint starka.
Men använd inte Perplexity som sista ordet. Kontrollera viktiga fakta manuellt när det gäller nyheter, känsliga påståenden, akademiskt arbete eller andra situationer där ett fel kan få stora konsekvenser.