สาเหตุไม่ได้อยู่ที่ AI Agent "ฉลาดน้อยกว่า" แต่อยู่ที่วิธีการทำงานที่ต่างกัน:
งานวิจัยพบว่า AI Agent เรียกใช้ LLM มากกว่าเฉลี่ย 9.2 เท่า เมื่อเทียบกับ Chatbot ทั่วไป HC และระยะเวลารอคอย (Latency) ก็เพิ่มขึ้น สูงสุดถึง 153.7 เท่า MBP
จุดที่น่าสนใจคือ การทำงานแบบหลายขั้นตอนของ AI Agent ทำให้ GPU ต้องหยุดรอคอยข้อมูลหรือผลลัพธ์จากขั้นตอนก่อนหน้าเป็นเวลานาน ทำให้ GPU มีช่วงเวลาว่างงาน (Idle Time) สูงถึง 54.5% ของเวลาทำงานทั้งหมด HM สะท้อนถึงความไม่มีประสิทธิภาพในการใช้ทรัพยากรฮาร์ดแวร์ขั้นสูง
ทีมวิจัยได้จำลองสถานการณ์ หากมีการใช้งาน AI Agent อย่างแพร่หลายถึง 1.37 หมื่นล้านครั้งต่อวัน ความต้องการไฟฟ้าสำหรับดาต้าเซ็นเตอร์อาจพุ่งสูงถึง 198.9 กิกะวัตต์ (GW) ซึ่งเป็นตัวเลขที่สูงเกินกว่าโครงการดาต้าเซ็นเตอร์ AI ระดับหลาย GW ที่หลายประเทศกำลังผลักดัน และคิดเป็น ประมาณครึ่งหนึ่งของความต้องการใช้ไฟฟ้าเฉลี่ยทั้งหมดของสหรัฐอเมริกา N