Perplexity AI, kısa ve olgusal soruları ölçen SimpleQA testinde %93,9 puan alıyor; bağımsız değerlendirmelerde genel olgusal doğruluk oranı %94 olarak raporlanıyor [10][16]. Son dakika haberlerinde tablo daha zayıf: NewsGuard denetimi, yapay zekâ sohbet araçlarının yanlış haber iddialarını Ağustos 2025'te %35 oranın...
YayımlayanDeepSeek-V4-Flash ile düzenlendiGörseller GPT Image 1.5 ile oluşturuldu
Research answer

Create a landscape editorial hero image for this Studio Global article: Searching with cited sources for How reliable is Perplexity AI?. Article summary: Perplexity AI's reliability varies notably by use case and metric. On standard factual benchmarks it scores in the low-to-mid 90% range, but independent audits show it still gets news facts wrong roughly one-third of the. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it
Perplexity AI'ın ne kadar doğru olduğunu sorunca karşınıza %93,9, %94, %65 ve %78 gibi farklı oranlar çıkabilir. Bu sayıların hiçbiri tek başına yanlış değil; ancak hiçbiri Perplexity'nin her tür soruda ne kadar güvenilir olduğunu anlatmıyor.
Platformun performansı; sorunun türüne, kullanılan kaynağa, ürün moduna ve doğruluğun nasıl ölçüldüğüne göre ciddi biçimde değişiyor. Genel olgusal sorularda Perplexity, piyasadaki en başarılı yapay zekâ arama araçları arasında yer alıyor. Buna karşılık son dakika haberlerinde, hassas iddialarda ve kapsamlı akademik çalışmalarda yanıtları mutlaka ayrıca kontrol edilmeli.
Standartlaştırılmış doğruluk testlerinde Perplexity rekabetçi puanlar alıyor. Kısa ve net olgusal yanıtları ölçmek için kullanılan SimpleQA testinde platformun %93,9 puan aldığı bildiriliyor. Bu, Perplexity'nin kamuya açık biçimde ilişkilendirilen en güçlü sonuçlarından biri .
AI Business Weekly tarafından aktarılan bağımsız değerlendirmelerde ise genel olgusal doğruluk %94 olarak veriliyor. Soru türlerine göre bildirilen oranlar şöyle :
Politika analizi, teknik sorun giderme ve şirket araştırması gibi iş odaklı sorulara yönelik profesyonel benchmark testlerinde Perplexity'nin %92 olgusal doğruluk elde ettiği, aynı testlerde ChatGPT'nin ise %87'de kaldığı raporlandı .
Perplexity'nin Haziran 2026'da duyurduğu DRACO benchmark'ına göre Deep Research modeli, Google DeepMind'ın DeepSearchQA ve Scale AI'ın ResearchRubrics testleri de dahil olmak üzere bazı harici benchmark'larda sektör lideri sonuçlar elde ediyor . Şirketin kendi açıkladığı bu sonuçlar, bağımsız bir genel doğruluk sertifikası olarak değil, belirli araştırma görevlerindeki performans göstergesi olarak değerlendirilmeli.
Benchmark sonuçları ile gerçek dünyadaki haber doğruluğu aynı tabloyu göstermiyor. NewsGuard'ın Eylül 2025'te yayımlanan denetimine göre yapay zekâ sohbet araçları, Ağustos 2025'te yanlış haber iddialarını %35 oranında tekrarladı. Bu oran bir önceki yıl %18'di .
Perplexity, test edilen önde gelen sohbet araçları arasında en belirgin performans düşüşünü yaşayan platform olarak öne çıktı. NewsGuard'ın 2024 testinde Perplexity doğru yanıt verme konusunda kusursuz bir sonuç almışken, 2025 denetiminde denemelerin neredeyse yarısında doğru yanıt veremedi .
Bağımsız güvenilirlik takipçisi TruthSignal da @AskPerplexity hesabının ortalama güvenilirliğini %65 olarak değerlendiriyor. Platformu genel sorular ve keşif amaçlı araştırmalar için kullanılabilir bulurken, doğrulama çalışmaları veya hassas konulardaki güvenilirliğinin tartışmalı olduğunu belirtiyor .
Bu farkın temel nedeni ölçüm koşullarıyla ilgili. Benchmark'lar genellikle sabit ve iyi belgelenmiş bilgileri test eder. Son dakika haberlerinde ise anlatılar hızla değişir, kaynaklar birbiriyle çelişebilir ve konu hakkında henüz güvenilir birincil kaynak bulunmayabilir. Yapay zekâ arama araçları tam da bu koşullarda daha fazla hata yapabilir.
Perplexity'nin en önemli vaadi, her yanıtı numaralı kaynaklarla desteklemesi. Bu sistem, kullanıcıya iddiaları tek tek kontrol etme imkânı veriyor. Ancak bir kaynağın listelenmesi, o kaynağın yanıtı gerçekten desteklediği anlamına gelmiyor.
Şubat-Mart 2026 döneminde gerçekleştirilen bir gerçek kullanım testinde, 847 Pro Search sorgusundaki 200 kaynak kontrol edildi. Kaynakların %78'i doğru bulundu . Başka bir ifadeyle, yaklaşık her beş kaynaktan biri yanıt içinde ileri sürülen iddiayı gerçekten desteklemiyordu.
Diğer incelemeler de kaynak kalitesinin değişken olduğunu belirtiyor. Akademik makaleler veya resmî belgelerle birlikte blog yazıları ve daha düşük otoriteli siteler de kaynak olarak gösterilebiliyor . Bazı kullanıcı testlerinde ise gerçekte var olmayan ya da konuyla ilgisiz sayfalara yönlendiren hatalı kaynaklar tespit edildi .
Akademik araştırma söz konusu olduğunda risk daha da önemli. Tow Center çalışmasına ilişkin değerlendirmelere göre Perplexity, test edilen yapay zekâ arama motorları arasında hatalı kaynak gösterme oranı en düşük araçlardan biri olsa da vakaların yaklaşık %37'sinde yanlış yanıt verdi. Bu, üç çıktının birinden fazlasında hata veya yanlış atfedilmiş iddia bulunabileceği anlamına geliyor .
Bağımsız incelemeler, Perplexity'nin güçlü ve zayıf yönleri konusunda büyük ölçüde benzer sonuçlara ulaşıyor .
İnternette sıkça tekrarlanan “%95 doğruluk” ifadesine rağmen Perplexity, tüm yanıt türlerini kapsayan ve bağımsız biçimde denetlenmiş tek bir doğruluk değerlendirmesi yayımlamış değil . Ölçülen performans; benchmark'a, ürün moduna, seçilen dil modeline, bilgi kaynağına, soru türüne ve doğruluğun tanımına göre değişiyor .
Bu nedenle %93,9'luk SimpleQA puanını tüm yanıtların %93,9'unun doğru olduğu şeklinde yorumlamak doğru olmaz. Aynı şekilde %78'lik kaynak doğruluğu da her sorgu için geçerli evrensel bir oran değil; belirli bir ürün ve test yöntemiyle elde edilmiş gerçek kullanım sonucudur.
Verilerin tamamı birlikte değerlendirildiğinde Perplexity, doğrulanabilir kaynaklara dayalı genel araştırmalar için en güvenilir yapay zekâ araçlarından biri olarak öne çıkıyor. Özellikle bilim, teknoloji, genel olgusal bilgiler ve yapılandırılmış konularda güçlü benchmark sonuçları veriyor. Numaralı kaynak sistemi de yanıtları kontrol etmeyi, yalnızca kapalı bir sohbet modeline kıyasla daha kolay hâle getiriyor.
Ancak bu avantaj, Perplexity'nin her yanıtının doğru olduğu anlamına gelmiyor. Son dakika haberlerinde, hassas iddialarda ve akademik çalışmalarda platformu nihai cevap olarak değil, araştırmaya başlamak için kullanılan bir yardımcı olarak görmek daha doğru. Kritik bilgileri resmî kurumlar, birincil kaynaklar ve güvenilir uzman yayınları üzerinden mutlaka manuel olarak doğrulayın.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Perplexity AI, kısa ve olgusal soruları ölçen SimpleQA testinde %93,9 puan alıyor; bağımsız değerlendirmelerde genel olgusal doğruluk oranı %94 olarak raporlanıyor [10][16].
Perplexity AI, kısa ve olgusal soruları ölçen SimpleQA testinde %93,9 puan alıyor; bağımsız değerlendirmelerde genel olgusal doğruluk oranı %94 olarak raporlanıyor [10][16]. Son dakika haberlerinde tablo daha zayıf: NewsGuard denetimi, yapay zekâ sohbet araçlarının yanlış haber iddialarını Ağustos 2025'te %35 oranında tekrarladığını ortaya koydu; Perplexity de en belirgin gerileme yaşayan...
Perplexity'nin kaynak gösterme sistemi yararlı olsa da kusursuz değil. Gerçek kullanım testlerinden birinde kaynakların yalnızca %78'i iddiayı doğru biçimde destekliyordu [13].