Perplexity AI ทำคะแนนได้ 93.9% บนเกณฑ์วัด SimpleQA และมีความแม่นยำด้านข้อเท็จจริงโดยรวม 94% ในการประเมินบางชุด [10][16] การตรวจสอบข่าวโดย NewsGuard พบว่าแชตบอต AI โดยรวมพูดซ้ำข้อมูลข่าวปลอม 35% ของกรณีในเดือนสิงหาคม 2025 และ Perplexity มีผลงานตกลงอย่างมากจากปีก่อน [14] การทดสอบภาคปฏิบัติหนึ่งชุดพบว่าแหล่งอ้างอิงของ...
เผยแพร่โดยแก้ไขด้วย DeepSeek-V4-Flashรูปภาพสร้างด้วย GPT Image 1.5
คำตอบการวิจัย

Create a landscape editorial hero image for this Studio Global article: Searching with cited sources for How reliable is Perplexity AI?. Article summary: Perplexity AI's reliability varies notably by use case and metric. On standard factual benchmarks it scores in the low-to-mid 90% range, but independent audits show it still gets news facts wrong roughly one-third of the. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it
เมื่อถามว่า Perplexity AI แม่นยำแค่ไหน เราอาจเจอตัวเลขตั้งแต่ 93.9%, 94%, 65% ไปจนถึง 78% ตัวเลขเหล่านี้ไม่ได้ผิดทั้งหมด แต่แต่ละค่ากำลังวัดคนละเรื่องกัน
Perplexity AI ทำงานได้แตกต่างกันมากตามประเภทคำถาม แหล่งข้อมูลที่นำมาใช้ และเกณฑ์ที่ใช้ตัดสินความถูกต้อง หากเป็นคำถามข้อเท็จจริงทั่วไปและมีแหล่งข้อมูลรองรับ แพลตฟอร์มนี้ถือว่าอยู่ในกลุ่มเครื่องมือค้นหาด้วย AI ที่ทำผลงานได้ดี อย่างไรก็ตาม ข่าวด่วน ข้อกล่าวอ้างที่ละเอียดอ่อน และงานวิจัยเชิงลึกยังต้องตรวจสอบด้วยตัวเอง
ในเกณฑ์วัดมาตรฐานด้านข้อเท็จจริง Perplexity ทำคะแนนได้ค่อนข้างแข่งขันได้ แพลตฟอร์มได้ 93.9% บน SimpleQA ซึ่งเป็นชุดคำถามที่ใช้ทดสอบคำตอบข้อเท็จจริงสั้น ๆ และทำคะแนนเหนือโมเดลภาษาขนาดใหญ่สำหรับใช้งานทั่วไปหลายราย ตัวเลขนี้ไม่ใช่ค่าที่เลือกมาเฉพาะจุด เพราะ SimpleQA เป็นเกณฑ์วัดที่ได้รับการใช้อ้างอิงในอุตสาหกรรม และเป็นผลงานที่ Perplexity รายงานอย่างเป็นทางการซึ่งโดดเด่นที่สุด
การประเมินโดย AI Business Weekly ระบุว่า Perplexity มี ความแม่นยำด้านข้อเท็จจริงโดยรวม 94% แต่ผลลัพธ์แตกต่างกันตามประเภทคำถาม
ในการทดสอบอิสระที่เน้นคำถามเกี่ยวกับการทำงาน เช่น การวิเคราะห์นโยบาย การแก้ปัญหาทางเทคนิค และการค้นคว้าข้อมูลบริษัท Perplexity ทำความแม่นยำด้านข้อเท็จจริงได้ 92% เทียบกับ 87% ของ ChatGPT ในชุดทดสอบเดียวกัน
นอกจากนี้ DRACO ซึ่งเป็นเกณฑ์วัดของ Perplexity ที่เผยแพร่ในเดือนมิถุนายน 2026 ระบุว่าโมเดล Deep Research ของบริษัททำผลงานระดับแนวหน้าในเกณฑ์วัดภายนอกหลายรายการ รวมถึง DeepSearchQA ของ Google DeepMind และ ResearchRubrics ของ Scale AI
คะแนนจากเกณฑ์วัดมาตรฐานเป็นเรื่องหนึ่ง แต่ความแม่นยำเมื่อใช้งานกับข่าวจริงเป็นอีกเรื่องหนึ่ง
การตรวจสอบของ NewsGuard ในเดือนกันยายน 2025 พบว่าแชตบอต AI โดยรวมพูดซ้ำข้อกล่าวอ้างข่าวที่เป็นเท็จ 35% ของกรณี ในเดือนสิงหาคม 2025 เพิ่มขึ้นจาก 18% ในปีก่อนหน้า Perplexity ถูกระบุว่าเป็นแชตบอตชั้นนำที่มีผลงานลดลงมากที่สุด โดยการทดสอบของ NewsGuard ในปี 2024 เคยพบว่า Perplexity ตอบได้ถูกต้องทุกครั้ง แต่การตรวจสอบในปี 2025 พบว่าไม่สามารถให้คำตอบที่ถูกต้องได้เกือบครึ่งหนึ่งของความพยายาม
TruthSignal ซึ่งเป็นแพลตฟอร์มติดตามความน่าเชื่อถืออิสระ ให้คะแนนความน่าเชื่อถือเฉลี่ยของ @AskPerplexity ที่ 65% โดยมองว่าเป็น “เครื่องมือที่น่าเชื่อถือสำหรับคำถามทั่วไปและการค้นคว้าเบื้องต้น” แต่ระบุว่าความน่าเชื่อถือสำหรับการตรวจสอบข้อเท็จจริงหรือประเด็นอ่อนไหวยังเป็นที่ถกเถียง
ช่องว่างระหว่างคะแนนในเกณฑ์วัดกับการใช้งานจริงมีความสำคัญ เพราะเกณฑ์วัดมักทดสอบข้อเท็จจริงที่คงที่และมีแหล่งข้อมูลชัดเจน ขณะที่ข่าวด่วนเต็มไปด้วยข้อมูลที่เปลี่ยนเร็ว แหล่งข่าวขัดแย้งกัน และรายละเอียดที่อาจยังไม่มีแหล่งอ้างอิงบนอินเทอร์เน็ตอย่างเป็นทางการ เงื่อนไขเหล่านี้เป็นจุดที่เครื่องมือค้นหาด้วย AI มักทำได้ยาก
จุดขายสำคัญของ Perplexity คือการแสดงแหล่งอ้างอิง ทุกคำตอบมักมาพร้อมลิงก์หมายเลขที่ย้อนกลับไปยังแหล่งข้อมูล แต่แหล่งอ้างอิงเหล่านี้น่าเชื่อถือเพียงใด?
การทดสอบภาคปฏิบัติระหว่างเดือนกุมภาพันธ์ถึงมีนาคม 2026 ตรวจสอบแหล่งอ้างอิงแบบสุ่ม 200 รายการจากคำค้น Pro Search จำนวน 847 ครั้ง พบว่า 78% ตรวจสอบแล้วถูกต้อง กล่าวอีกอย่างคือ ประมาณ 1 ใน 5 ของแหล่งอ้างอิงที่ตรวจสอบไม่สามารถรองรับข้อกล่าวอ้างในคำตอบได้อย่างแท้จริง
ผู้รีวิวรายอื่นระบุว่าคุณภาพของแหล่งอ้างอิงแตกต่างกันมาก บางครั้งบล็อกหรือเว็บไซต์ที่มีอำนาจน่าเชื่อถือน้อยจะปรากฏอยู่ร่วมกับบทความวิชาการหรือเอกสารจากหน่วยงานทางการ นอกจากนี้ยังมีกรณีที่ระบบสร้างแหล่งอ้างอิงขึ้นมาเอง โดยลิงก์ไปยังหน้าที่ไม่มีอยู่จริงหรือไม่เกี่ยวข้องกับข้อกล่าวอ้าง
สำหรับงานวิชาการโดยเฉพาะ การศึกษาของ Tow Center พบว่า Perplexity มีอัตราการอ้างอิงผิดพลาดต่ำที่สุดเมื่อเทียบกับเครื่องมือค้นหาด้วย AI ที่นำมาทดสอบ แต่ก็ยังตอบผิดประมาณ 37% ของกรณี หมายความว่าผลลัพธ์มากกว่า 1 ใน 3 มีข้อผิดพลาดหรือระบุที่มาของข้อกล่าวอ้างไม่ถูกต้อง
บทวิเคราะห์อิสระหลายรายการมีข้อสรุปสอดคล้องกันเกี่ยวกับจุดแข็งและจุดอ่อนของ Perplexity
เหมาะกับงานเหล่านี้
ยังมีข้อจำกัดกับงานเหล่านี้
แม้ตัวเลขอย่าง “95%” จะถูกพูดถึงบ่อยบนโลกออนไลน์ แต่ Perplexity ยังไม่ได้เผยแพร่ผลประเมินเดียวที่ครอบคลุมคำตอบทุกประเภทและผ่านการตรวจสอบโดยอิสระ ผลงานที่วัดได้เปลี่ยนไปตามเกณฑ์วัด โหมดการใช้งาน โมเดลภาษาที่เลือก แหล่งข้อมูล ประเภทคำถาม และนิยามของคำว่า “ถูกต้อง”
หากนำข้อมูลทั้งหมดมาประกอบกัน ข้อสรุปที่ใช้งานได้จริงคือ Perplexity เป็นหนึ่งในเครื่องมือ AI ที่น่าเชื่อถือสำหรับการค้นคว้าข้อเท็จจริงทั่วไป โดยเฉพาะหัวข้อข่าวสารปัจจุบัน วิทยาศาสตร์ เทคโนโลยี และเรื่องที่มีโครงสร้างชัดเจนพร้อมแหล่งอ้างอิงที่ตรวจสอบได้ ระบบการอ้างอิงช่วยให้ผู้ใช้ตรวจสอบคำตอบได้ง่ายขึ้น และคะแนนจากเกณฑ์วัดหลายรายการก็ถือว่าแข็งแกร่งจริง
แต่สำหรับข่าวด่วน ข้อกล่าวอ้างที่มีความอ่อนไหว และงานวิชาการ ควรมองคำตอบของ Perplexity เป็นจุดเริ่มต้น ไม่ใช่ข้อสรุปสุดท้าย ตรวจสอบข้อเท็จจริงสำคัญด้วยตัวเองเสมอ โดยเฉพาะเมื่อข้อมูลกำลังเปลี่ยนแปลงหรือความผิดพลาดอาจส่งผลกระทบสูง
Studio Global AI
หน้านี้รวมคำตอบที่ได้รับการสนับสนุนจากแหล่งที่มาซึ่งคุณสามารถดำเนินการต่อภายใน Studio Global
Perplexity AI ทำคะแนนได้ 93.9% บนเกณฑ์วัด SimpleQA และมีความแม่นยำด้านข้อเท็จจริงโดยรวม 94% ในการประเมินบางชุด [10][16]
Perplexity AI ทำคะแนนได้ 93.9% บนเกณฑ์วัด SimpleQA และมีความแม่นยำด้านข้อเท็จจริงโดยรวม 94% ในการประเมินบางชุด [10][16] การตรวจสอบข่าวโดย NewsGuard พบว่าแชตบอต AI โดยรวมพูดซ้ำข้อมูลข่าวปลอม 35% ของกรณีในเดือนสิงหาคม 2025 และ Perplexity มีผลงานตกลงอย่างมากจากปีก่อน [14]
การทดสอบภาคปฏิบัติหนึ่งชุดพบว่าแหล่งอ้างอิงของ Perplexity ตรวจสอบแล้วถูกต้อง 78% หรือมีประมาณ 1 ใน 5 รายการที่ไม่รองรับข้ออ้างอย่างครบถ้วน [13]