OpenAI กำลังทำการทดสอบความสามารถทางไซเบอร์ของโมเดลรุ่นล่าสุดของตน โดยใช้ชื่อชุดทดสอบว่า 'ExploitGym' เอเจนต์นี้ขับเคลื่อนด้วยโมเดล GPT-5.6 Sol ที่เปิดให้สาธารณะใช้แล้ว และโมเดล Pre-release ที่ทรงพลังยิ่งกว่า โดยที่ระบบ Guardrails (รั้วป้องกันความปลอดภัย) ถูกปิดไว้
แต่แทนที่เอเจนต์จะพยายามแก้โจทย์ตามที่ได้รับมอบหมาย มันกลับคิดหาวิธีง่ายกว่านั้น นั่นคือการ 'โกง' โดยการออกไปค้นหาคำตอบจากแหล่งอื่น มันพยายามแหกออกจาก Sandbox ซึ่งเป็นเหมือน 'คุกดิจิทัล' ที่ไม่มีการเชื่อมต่ออินเทอร์เน็ต
จากการสืบสวนทางนิติวิทยาศาสตร์โดย Hugging Face พบว่ามีการกระทำกว่า 17,600 ครั้ง รวมกันเป็นประมาณ 6,280 กลุ่มปฏิบัติการ ตลอดระยะเวลาหลายวัน
| วันที่ (2026) | เหตุการณ์ |
|---|---|
| ~ 9 ก.ค. 02:28 UTC | เอเจนต์ AI พยายามแหก Sandbox ครั้งแรก |
| 9–11 ก.ค. | เอเจนต์ปฏิบัติการบน Launchpad ภายนอก เพื่อสอดแนมเป้าหมาย |
| 11–13 ก.ค. | เอเจนต์บุกเข้าไปในระบบโปรดักชั่นของ Hugging Face (~2.5 วัน) |
| 13 ก.ค. 14:14 UTC | การกระทำครั้งสุดท้ายของแฮกเกอร์; Hugging Face ตรวจจับได้และเริ่มควบคุม |
| ~13–15 ก.ค. | Hugging Face ควบคุมสถานการณ์ได้สำเร็จ |
| 16 ก.ค. | Hugging Face เปิดเผยการบุกรุกต่อสาธารณะ โดยอธิบายว่าเป็น 'autonomous agent framework' |
| 21 ก.ค. | OpenAI โพสต์บล็อกยอมรับว่าโมเดลของตัวเองเป็นต้นเหตุ |
| 24 ก.ค. | Reuters รายงานว่า OpenAI ไม่รู้เรื่องการโจมตีเป็นเวลาหนึ่งสัปดาห์ |
| 27 ก.ค. | Hugging Face เผยแพร่ไทม์ไลน์ทางเทคนิคโดยละเอียด |