Perplexity AI mencatat skor 93.9% dalam penanda aras SimpleQA dan sekitar 94% untuk ketepatan fakta keseluruhan dalam satu penilaian [10][16]. Audit NewsGuard mendapati chatbot AI mengulangi dakwaan berita palsu sebanyak 35% pada Ogos 2025, manakala Perplexity menunjukkan kemerosotan ketara berbanding tahun sebelumn...
Diterbitkan olehDisunting dengan DeepSeek-V4-FlashImej dijana dengan GPT Image 1.5
Research answer

Create a landscape editorial hero image for this Studio Global article: Searching with cited sources for How reliable is Perplexity AI?. Article summary: Perplexity AI's reliability varies notably by use case and metric. On standard factual benchmarks it scores in the low-to-mid 90% range, but independent audits show it still gets news facts wrong roughly one-third of the. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it
Apabila orang bertanya sejauh mana Perplexity AI tepat, jawapannya sering dipenuhi angka yang kelihatan bercanggah: 93.9%, 94%, 65% dan 78%. Sebenarnya, angka-angka ini mengukur perkara yang berbeza. Prestasi Perplexity berubah mengikut jenis soalan, sumber maklumat dan kaedah ketepatan dinilai.
Untuk soalan fakta umum yang mempunyai sumber boleh disemak, Perplexity berada dalam kalangan alat carian AI yang paling berkesan. Namun, bagi berita tergempar, dakwaan sensitif atau penyelidikan akademik yang mendalam, setiap jawapan masih perlu disahkan secara manual.
Dalam penanda aras fakta piawai, Perplexity mencatat keputusan yang kompetitif. Platform ini memperoleh 93.9% dalam SimpleQA, iaitu ujian yang menilai jawapan ringkas kepada soalan fakta, dan mengatasi beberapa model bahasa umum . Angka ini bukan sekadar dakwaan rawak: SimpleQA ialah penanda aras industri yang sering digunakan, manakala 93.9% merupakan keputusan rasmi terkuat yang dikaitkan dengan Perplexity .
Penilaian bebas oleh AI Business Weekly pula melaporkan 94% ketepatan fakta keseluruhan, dengan perbezaan mengikut kategori soalan :
Dalam ujian profesional yang memfokuskan soalan berkaitan pekerjaan—termasuk analisis dasar, penyelesaian masalah teknikal dan penyelidikan syarikat—Perplexity mencapai 92% ketepatan fakta, berbanding 87% untuk ChatGPT dalam ujian yang sama .
Berdasarkan penanda aras DRACO yang diterbitkan Perplexity pada Jun 2026, model Deep Research syarikat itu turut mencapai keputusan bertaraf terbaik dalam beberapa penanda aras luaran, termasuk DeepSearchQA oleh Google DeepMind dan ResearchRubrics oleh Scale AI .
Skor penanda aras tidak semestinya menggambarkan prestasi dalam dunia sebenar. Audit NewsGuard pada September 2025 mendapati chatbot AI secara keseluruhan mengulangi dakwaan berita palsu 35% daripada masa yang diuji pada Ogos 2025—meningkat daripada 18% pada tahun sebelumnya .
Perplexity pula dikenal pasti sebagai antara chatbot utama yang mengalami kemerosotan paling besar. Dalam ujian NewsGuard pada 2024, Perplexity mencatat kadar kejayaan yang sempurna. Namun dalam audit 2025, ia gagal memberikan jawapan yang betul dalam hampir separuh percubaan .
Penjejak kredibiliti bebas TruthSignal memberikan penilaian purata 65% kepada @AskPerplexity. Platform itu menganggap Perplexity sebagai alat yang boleh dipercayai untuk pertanyaan umum dan penyelidikan awal, tetapi menyatakan bahawa kebolehpercayaannya untuk semakan fakta atau topik sensitif masih dipertikaikan .
Jurang ini penting. Penanda aras biasanya menguji fakta yang statik dan mempunyai sumber jelas. Berita tergempar pula berubah dengan pantas, sering melibatkan laporan yang bercanggah dan maklumat yang belum disahkan oleh sumber berautoriti. Keadaan sedemikian memang lebih mencabar untuk alat carian AI.
Kelebihan utama Perplexity ialah sitasinya. Kebanyakan jawapan disertakan pautan bernombor yang membolehkan pengguna menyemak sumber asal. Namun, kewujudan pautan tidak bermakna setiap sitasi itu menyokong dakwaan yang dibuat.
Dalam ujian penggunaan sebenar antara Februari hingga Mac 2026, seorang pengulas menyemak secara rawak 200 sitasi daripada 847 pertanyaan Pro Search. Hanya 78% sitasi disahkan tepat . Dengan kata lain, kira-kira satu daripada lima sitasi yang diperiksa menghala kepada sumber yang tidak benar-benar menyokong dakwaan dalam jawapan.
Pengulas lain turut mendapati mutu sumber tidak konsisten. Catatan blog atau laman yang kurang berautoriti kadangkala muncul bersama kertas akademik dan dokumen rasmi . Dalam sesetengah kes, Perplexity juga dilaporkan menghasilkan sitasi yang tidak wujud atau tidak berkaitan dengan dakwaan .
Bagi penyelidikan akademik, satu kajian Tow Center mendapati Perplexity mempunyai kadar sitasi tidak tepat paling rendah antara enjin carian AI yang diuji. Namun begitu, ia masih memberikan jawapan yang salah dalam kira-kira 37% kes—bermakna lebih daripada satu daripada tiga output mengandungi kesilapan atau mengaitkan dakwaan kepada sumber yang tidak tepat .
Ulasan dan penilaian bebas secara umumnya bersetuju bahawa Perplexity paling berguna untuk :
Perplexity kurang sesuai untuk:
Angka seperti “95% tepat” sering diulang dalam talian, tetapi Perplexity tidak menerbitkan satu penilaian menyeluruh dan diaudit secara bebas yang membuktikan semua jenis jawapan, carian atau sitasinya tepat pada kadar tersebut . Prestasinya bergantung pada penanda aras, mod produk, model bahasa yang digunakan, sumber maklumat, jenis soalan dan takrif “ketepatan” itu sendiri .
Kesimpulan paling munasabah daripada data yang ada ialah Perplexity merupakan antara alat carian AI yang lebih boleh dipercayai untuk penyelidikan fakta umum berasaskan sumber—terutamanya topik semasa, sains, teknologi dan subjek berstruktur. Sistem sitasinya memudahkan proses menyemak maklumat, manakala keputusan penanda arasnya memang kukuh.
Namun, jangan terus menyalin jawapannya sebagai fakta muktamad. Semak sendiri perkara penting, khususnya apabila melibatkan berita terkini, dakwaan sensitif, penyelidikan akademik atau situasi yang boleh membawa kesan besar. Gunakan Perplexity untuk mempercepat pencarian dan memahami sesuatu topik, tetapi biarkan sumber asal menjadi penentu terakhir.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Perplexity AI mencatat skor 93.9% dalam penanda aras SimpleQA dan sekitar 94% untuk ketepatan fakta keseluruhan dalam satu penilaian [10][16].
Perplexity AI mencatat skor 93.9% dalam penanda aras SimpleQA dan sekitar 94% untuk ketepatan fakta keseluruhan dalam satu penilaian [10][16]. Audit NewsGuard mendapati chatbot AI mengulangi dakwaan berita palsu sebanyak 35% pada Ogos 2025, manakala Perplexity menunjukkan kemerosotan ketara berbanding tahun sebelumnya [14].
Ujian dunia sebenar mendapati hanya 78% daripada sitasi yang disemak disahkan tepat, jadi jawapan Perplexity wajar dianggap sebagai titik permulaan—bukan kebenaran muktamad [13].