Nezávislé hodnocení AI Business Weekly uvádí 94% celkovou faktickou přesnost, která se liší podle typu dotazu :
V profesionálním testování pracovních dotazů, zahrnujícím například analýzu politik, řešení technických problémů nebo průzkum firem, dosáhla Perplexity 92% faktické přesnosti. Ve stejných testech získal ChatGPT 87 % .
Vlastní benchmark DRACO společnosti Perplexity z června 2026 dále uvádí, že model Deep Research dosahuje špičkových výsledků v externích testech, včetně DeepSearchQA od Google DeepMind a ResearchRubrics od Scale AI .
Benchmarky vyprávějí jen jednu část příběhu. Každodenní práce s aktuálními zprávami ukazuje podstatně méně jistý obraz.
Audit společnosti NewsGuard zpracovaný v září 2025 zjistil, že AI chatboti v srpnu 2025 opakovali nepravdivá tvrzení o zprávách ve 35 % případů. O rok dříve to bylo 18 % . Perplexity byla mezi předními testovanými chatboty označena za nástroj s nejvýraznějším zhoršením. Zatímco v testu NewsGuardu z roku 2024 dosáhla bezchybného výsledku, v roce 2025 nedokázala dodat správnou odpověď téměř v polovině pokusů .
Nezávislý projekt TruthSignal hodnotí průměrnou důvěryhodnost účtu @AskPerplexity na 65 %. Perplexity podle něj představuje důvěryhodný nástroj pro obecné dotazy a průzkumný výzkum, její použití k ověřování faktů nebo u citlivých témat je ale sporné .
Rozdíl mezi výsledky benchmarků a realitou zpravodajství je důležitý. Benchmarky obvykle testují statická a dobře zdokumentovaná fakta. Aktuální události se naproti tomu rychle vyvíjejí, zdroje si mohou protiřečit a spolehlivé informace ještě nemusí být na veřejném webu dostupné. Právě v takových podmínkách mají AI vyhledávače největší potíže.
Jednou z hlavních předností Perplexity jsou citace. Odpovědi obsahují očíslované odkazy na zdroje, takže si můžete tvrzení rychle zkontrolovat. Jak přesné jsou ale samotné citace?
V praktickém testu prováděném od února do března 2026 jeden recenzent namátkově ověřil 200 citací z celkem 847 dotazů v režimu Pro Search. Jako přesných bylo potvrzeno 78 % citací . Přibližně jeden z pěti odkazů tedy vedl ke zdroji, který tvrzení skutečně nepodporoval.
Další recenze upozorňují, že kvalita zdrojů se výrazně liší. Vedle akademických prací nebo oficiálních dokumentů se někdy objevují blogy a méně autoritativní weby . Některé citace mohou být dokonce vymyšlené a odkazovat na neexistující či nesouvisející stránky .
U akademického výzkumu je laťka ještě výš. Studie Tow Centeru zjistila, že Perplexity měla mezi testovanými AI vyhledávači nejnižší podíl chybných citací, přesto odpověděla nesprávně přibližně v 37 % případů . Více než jeden ze tří výstupů tedy obsahoval chybu nebo nesprávně přiřazené tvrzení.
Nezávislé recenze se v hlavních přednostech a slabinách Perplexity do značné míry shodují .
Nejlepší využití:
Méně vhodné využití:
Přestože se na internetu často opakuje údaj „95% přesnost“, Perplexity nezveřejnila univerzální, nezávisle auditované hodnocení, které by potvrzovalo správnost 95 % všech odpovědí, vyhledávání nebo citací . Naměřený výsledek se mění podle benchmarku, režimu produktu, použitého jazykového modelu, informačních zdrojů, typu otázky i definice přesnosti .
Nejrozumnější shrnutí všech dostupných údajů zní takto: Pro obecný faktický výzkum s ověřitelnými zdroji — zejména u vědy, technologií a strukturovaných témat — patří Perplexity mezi nejspolehlivější AI nástroje. Její citační systém výrazně usnadňuje kontrolu informací a výsledky v některých benchmarkech jsou skutečně velmi dobré.
U zpráv, citlivých tvrzení a akademické práce ji ale používejte jako výchozí bod, nikoli jako poslední slovo. Důležitá fakta si ověřte ručně, ideálně v původním dokumentu nebo u více důvěryhodných zdrojů — především tehdy, když se informace rychle mění nebo na výsledku skutečně záleží.