Perplexity raggiunge il 93,9% nel benchmark SimpleQA e circa il 94% nelle valutazioni sull’accuratezza fattuale, ma non esiste una percentuale unica valida per ogni risposta [2][10]. Le prestazioni peggiorano con le notizie in rapido aggiornamento: un audit NewsGuard ha rilevato che i chatbot AI hanno ripetuto affer...
Pubblicato daModificato con DeepSeek-V4-FlashImmagini generate con GPT Image 1.5
Research answer

Create a landscape editorial hero image for this Studio Global article: Searching with cited sources for How reliable is Perplexity AI?. Article summary: Perplexity AI's reliability varies notably by use case and metric. On standard factual benchmarks it scores in the low-to-mid 90% range, but independent audits show it still gets news facts wrong roughly one-third of the. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it
Chiedersi quanto sia accurato Perplexity AI può portare a una serie di percentuali apparentemente contraddittorie: 93,9%, 94%, 65% o 78%. In realtà, questi numeri misurano aspetti diversi. L’affidabilità di Perplexity cambia in base al tipo di domanda, alla qualità delle fonti disponibili e al criterio usato per definire una risposta “corretta”.
Per le domande fattuali generali e per la ricerca con fonti verificabili, Perplexity è tra gli strumenti di ricerca basati sull’intelligenza artificiale più solidi oggi disponibili. Ma quando si parla di notizie dell’ultima ora, affermazioni delicate o ricerca accademica approfondita, le sue risposte vanno controllate con attenzione.
Nei test standardizzati sulle informazioni fattuali, Perplexity ottiene risultati competitivi. La piattaforma ha raggiunto il 93,9% nel benchmark SimpleQA, progettato per valutare risposte brevi a domande fattuali, superando diversi modelli linguistici generalisti .
Non si tratta di una percentuale riferita a tutte le risposte possibili: SimpleQA misura un tipo specifico di capacità, cioè il recupero di informazioni fattuali concise. È comunque il risultato ufficiale più forte associato a Perplexity tra quelli riportati nelle fonti analizzate .
Le valutazioni di AI Business Weekly indicano inoltre un’accuratezza fattuale complessiva del 94%, con variazioni a seconda della categoria :
In test indipendenti incentrati su attività professionali — tra cui analisi di policy, risoluzione di problemi tecnici e ricerca su aziende — Perplexity avrebbe raggiunto il 92% di accuratezza fattuale, contro l’87% di ChatGPT nelle stesse prove .
Anche il benchmark DRACO pubblicato da Perplexity nel giugno 2026 segnala risultati di primo piano per il modello Deep Research in test esterni come DeepSearchQA di Google DeepMind e ResearchRubrics di Scale AI . Si tratta però di risultati relativi a specifici benchmark, non di una garanzia generale su qualsiasi risposta.
I benchmark raccontano solo una parte della storia. Le notizie in tempo reale sono molto più difficili da gestire: le informazioni si aggiornano di ora in ora, le fonti possono contraddirsi e una conferma autorevole potrebbe non essere ancora disponibile online.
Un audit NewsGuard del settembre 2025 ha rilevato che, nel complesso, i chatbot AI hanno ripetuto affermazioni false sulle notizie nel 35% dei casi analizzati nell’agosto dello stesso anno, rispetto al 18% dell’anno precedente . Perplexity è stato indicato tra i chatbot con il peggior calo di prestazioni: nel test di verifica del 2024 aveva ottenuto un risultato perfetto, mentre nel 2025 non ha fornito una risposta corretta in quasi la metà dei tentativi .
Un altro indicatore, TruthSignal, assegna a @AskPerplexity una credibilità media del 65%. Il servizio lo considera uno strumento credibile per domande generali e ricerca esplorativa, ma segnala dubbi sulla sua affidabilità nel fact-checking e sui temi sensibili .
La distanza tra i punteggi dei benchmark e l’esperienza sulle notizie è quindi importante. Un test statico valuta fatti relativamente stabili e ben documentati; una notizia in evoluzione presenta invece proprio le condizioni in cui i motori di ricerca AI possono sbagliare più facilmente.
Il principale vantaggio di Perplexity rispetto a un chatbot tradizionale è il sistema di citazioni. Le risposte includono collegamenti numerati alle pagine consultate, permettendo di controllare più rapidamente l’origine delle informazioni. Ma una citazione non è necessariamente una prova che sostiene davvero ogni frase.
In un test pratico svolto tra febbraio e marzo 2026, un recensore ha verificato a campione 200 citazioni raccolte durante 847 query con Pro Search. Il 78% è risultato accurato . In altri termini, circa una citazione su cinque non conduceva a una fonte che supportasse pienamente l’affermazione associata.
Altre recensioni rilevano che la qualità delle fonti può variare molto: accanto a documenti ufficiali o articoli accademici possono comparire blog e pagine meno autorevoli . In alcuni casi sono stati segnalati anche collegamenti inventati, irrilevanti o diretti a pagine inesistenti .
Per la ricerca accademica il margine di errore è ancora più delicato. Secondo una valutazione che cita uno studio del Tow Center, Perplexity ha mostrato il tasso più basso di citazioni errate tra i motori di ricerca AI esaminati, ma ha comunque fornito risposte sbagliate in circa il 37% dei casi . È un risultato migliore di quello di alcuni concorrenti, ma troppo incostante per usare le risposte senza controllare direttamente gli studi e le fonti originali.
Le valutazioni indipendenti convergono su alcuni punti di forza . Perplexity tende a essere più utile per:
Il suo valore sta soprattutto nel ridurre il tempo necessario per orientarsi tra molte pagine web. La risposta sintetica e i riferimenti numerati offrono un punto di partenza più pratico rispetto a una semplice lista di risultati.
Perplexity è meno prevedibile quando deve:
In questi casi, la presenza di una citazione può dare un’impressione di certezza superiore a quella giustificata dal contenuto. Conviene aprire i riferimenti, leggere il passaggio originale e confrontarlo con almeno un’altra fonte autorevole.
La percentuale “95%” viene spesso ripetuta online, ma Perplexity non ha pubblicato una valutazione universale, indipendente e verificata che dimostri che il 95% di tutte le sue risposte, ricerche o citazioni sia corretto . Le prestazioni dipendono dal benchmark, dalla modalità del prodotto, dal modello linguistico utilizzato, dalle fonti disponibili, dal tipo di domanda e dalla definizione stessa di accuratezza .
Il quadro più realistico è questo: Perplexity è uno dei migliori strumenti AI per la ricerca fattuale con fonti verificabili, soprattutto su tecnologia, scienza, attualità generale e argomenti strutturati. I suoi benchmark sono solidi e il sistema di citazioni rende più semplice controllare le informazioni.
Non è però un arbitro definitivo della verità. Per le notizie in rapido sviluppo, le accuse, i temi sensibili e il lavoro accademico, va considerato un punto di partenza. Le informazioni importanti devono essere verificate manualmente, in particolare quando un errore può avere conseguenze concrete.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Perplexity raggiunge il 93,9% nel benchmark SimpleQA e circa il 94% nelle valutazioni sull’accuratezza fattuale, ma non esiste una percentuale unica valida per ogni risposta [2][10].
Perplexity raggiunge il 93,9% nel benchmark SimpleQA e circa il 94% nelle valutazioni sull’accuratezza fattuale, ma non esiste una percentuale unica valida per ogni risposta [2][10]. Le prestazioni peggiorano con le notizie in rapido aggiornamento: un audit NewsGuard ha rilevato che i chatbot AI hanno ripetuto affermazioni false nel 35% dei casi, mentre Perplexity ha mostrato un forte calo rispett...
Le citazioni sono un punto di forza, ma non sono infallibili: in un test pratico del 2026 solo il 78% dei riferimenti verificati risultava accurato [13].