เหตุผลที่ชื่อ GPT-5.4 มีความสำคัญ เพราะ OpenAI ระบุว่า GPT-5.4 นำความสามารถด้านโค้ดของ GPT-5.3-Codex เข้ามา และปรับปรุงการทำงานกับเครื่องมือ สภาพแวดล้อมซอฟต์แวร์ สเปรดชีต งานนำเสนอ และเอกสารต่าง ๆ OpenAI ยังระบุว่า GPT-5.4 ทำคะแนน GDPval ได้ 83.0% โดย GDPval เป็น benchmark สำหรับงานความรู้ที่กำหนดโจทย์ชัดเจน ครอบคลุม 44 อาชีพ เทียบกับ GPT-5.2 ที่ได้ 70.9%
อย่างไรก็ตาม ตัวเลขเหล่านี้เป็นบริบทของ GPT-5.4 ฐาน ไม่ใช่คะแนนด้านไซเบอร์ของ GPT-5.4-Cyber โดยตรง แหล่งข้อมูลที่มีไม่ได้เปิดเผย scorecard สาธารณะของ GPT-5.4-Cyber สำหรับงานอย่างการค้นหาช่องโหว่ การรับมือเหตุการณ์ การวิเคราะห์ย้อนกลับ การวิเคราะห์มัลแวร์ หรือโจทย์แข่งขันแบบ capture-the-flag
GPT-5.4-Cyber ไม่ได้ถูกนำเสนอเป็นฟีเจอร์สำหรับผู้ใช้ ChatGPT ทั่วไป CNET รายงานว่าโมเดลนี้ไม่ได้จะมาอยู่ใน ChatGPT ของคุณ และเป็นส่วนหนึ่งของโครงการ Trusted Access for Cyber สำหรับผู้เชี่ยวชาญและองค์กรด้านความปลอดภัยไซเบอร์ที่ผ่านการตรวจสอบ
OpenAI อธิบาย Trusted Access for Cyber ว่าเป็นความพยายามในการขยายการเข้าถึงโมเดลระดับแนวหน้าสำหรับการป้องกันไซเบอร์ โดยใช้แนวทางที่อิงกับความน่าเชื่อถือ รายงานอื่นก็ชี้ไปในทิศทางเดียวกัน: 9to5Mac ระบุว่าการเข้าถึงจำกัดสำหรับผู้ใช้ระดับสูงสุดที่ยินดีพิสูจน์ตัวตนว่าเป็นผู้เชี่ยวชาญด้านไซเบอร์ ขณะที่ TechXplore ระบุว่า GPT-5.4-Cyber จะเปิดให้บุคคลและองค์กรระดับสูงสุดในโครงการ Trusted Access for Cyber ใช้งาน
TheLec ยังอธิบายการเปิดใช้งานว่าอยู่ภายใต้กรอบควบคุมที่มีผู้ใช้ที่ผ่านการตรวจสอบ การยืนยันตัวตน และข้อกำหนดด้านการติดตามตรวจสอบ สรุปแบบตรงไปตรงมาคือ หากบุคคลหรือองค์กรไม่ได้ผ่านเส้นทาง trusted access ของ OpenAI ก็ควรมองว่า GPT-5.4-Cyber ยังไม่พร้อมให้ใช้งานทั่วไป
คำว่า cyber-permissive ไม่ได้แปลว่าใช้งานได้โดยไร้ข้อจำกัด คำอธิบายสาธารณะที่ชัดที่สุดคือ OpenAI กำลัง fine-tune โมเดลเพื่อรองรับ use case ด้านความปลอดภัยไซเบอร์เชิงป้องกัน โดยเริ่มจากตัวแปรของ GPT-5.4 ที่ฝึกให้ cyber-permissive มากขึ้น ซึ่งก็คือ GPT-5.4-Cyber
ความแตกต่างตรงนี้สำคัญมาก แชตบอตสาธารณะอาจปฏิเสธหรือจำกัดคำขอด้านไซเบอร์จำนวนมาก เพราะความรู้ชุดเดียวกันอาจถูกนำไปใช้ในทางที่ผิดได้ แต่โมเดลสำหรับฝ่ายป้องกันที่ผ่านการคัดกรองแล้ว อาจให้พื้นที่แก่ผู้ใช้ที่ได้รับอนุญาตมากขึ้นในการทำงานที่ถูกต้องตามขอบเขต โดยยังมีการยืนยันตัวตน การติดตามตรวจสอบ และการควบคุมสิทธิ์เข้าถึง
CNET รายงานว่า OpenAI ใช้ feedback จากผู้ทดสอบเพื่อทำความเข้าใจประโยชน์และความเสี่ยงเฉพาะของโมเดล ปรับปรุงความทนทานต่อ jailbreak และการโจมตีเชิงปฏิปักษ์ เพิ่มความสามารถเชิงป้องกัน และลดอันตรายที่อาจเกิดขึ้น ภาพรวมจึงไม่ใช่ผู้ช่วยโจมตีที่เปิดสาธารณะ แต่เป็นการทดลองแบบควบคุมในการให้ฝ่ายป้องกันเข้าถึง AI ที่ทรงพลังขึ้นโดยไม่ปล่อยความสามารถเดียวกันออกสู่ผู้ใช้ทั่วไป
ข้อสรุปที่ยืนยันได้จากข้อมูลสาธารณะคือ GPT-5.4-Cyber ถูกตั้งใจให้ใช้กับงานความปลอดภัยไซเบอร์เชิงป้องกัน TheLec รายงานถึงความสามารถขั้นสูง เช่น การวิเคราะห์ย้อนกลับไฟล์ไบนารี หรือ binary reverse engineering แต่ประเด็นนี้เป็นการรายงานเกี่ยวกับการเปิดตัว ไม่ใช่ผลประเมินทางเทคนิคอิสระ
จึงพอคาดได้ว่าโมเดลอาจเป็นประโยชน์กับงานความปลอดภัยที่เกี่ยวข้องกับโค้ด เพราะ OpenAI อธิบายว่า GPT-5.4 แข็งแรงขึ้นในด้านโค้ด การใช้เครื่องมือ และสภาพแวดล้อมซอฟต์แวร์ แต่หลักฐานที่มีไม่ได้พิสูจน์ประสิทธิภาพแบบแยกตามงานของ GPT-5.4-Cyber เอง
สรุปความสามารถอย่างระมัดระวังได้ดังนี้:
รูปแบบการเข้าถึงคือหัวใจของ GPT-5.4-Cyber โครงการ Trusted Access for Cyber ถูกวางกรอบว่าเป็นการขยายการเข้าถึงโมเดลระดับแนวหน้าเพื่อการป้องกันไซเบอร์ พร้อมใช้แนวทางที่อิงกับความไว้วางใจเพื่อจัดการความเสี่ยง
เหตุผลนี้เข้าใจได้ไม่ยาก ทีมป้องกันไซเบอร์มักต้องการโมเดลที่ช่วยคิดเรื่องช่องโหว่ กลไก exploit log ระบบ ไฟล์ไบนารี และโค้ดต้องสงสัย แต่ความสามารถแบบเดียวกันก็อาจถูกนำไปใช้ผิดวัตถุประสงค์ได้ การจำกัด GPT-5.4-Cyber ให้เฉพาะผู้ใช้หรือองค์กรระดับสูงที่ผ่านการตรวจสอบจึงดูเหมือนความพยายามของ OpenAI ในการเพิ่มประโยชน์ให้ฝ่ายป้องกัน โดยไม่ปล่อยโมเดลที่ permissive ด้านไซเบอร์ออกสู่การใช้งานทั่วไป
ยังมีรายละเอียดสำคัญหลายอย่างที่แหล่งข้อมูลนี้ไม่ได้เปิดเผยต่อสาธารณะ:
GPT-5.4-Cyber คือโมเดล GPT-5.4 แบบจำกัดสิทธิ์ของ OpenAI สำหรับผู้ป้องกันภัยไซเบอร์ที่เชื่อถือได้ ไม่ใช่การอัปเกรด ChatGPT ทั่วไป และหลักฐานที่มีชี้ว่าเป็นการใช้งานด้านความปลอดภัยเชิงป้องกันภายใต้การควบคุมมากกว่าโมเดลที่เปิดสำหรับทุกคน
จุดที่น่าสนใจคือ GPT-5.4 ฐานถูกนำเสนอว่าแข็งแรงขึ้นด้านโค้ด การใช้เครื่องมือ และงานวิชาชีพกว้าง ๆ รวมถึงผล GDPval 83.0% แต่ประสิทธิภาพด้านไซเบอร์ของ GPT-5.4-Cyber ยังไม่ถูกเปิดเผยแบบชัดเจน จนกว่า OpenAI หรือผู้ประเมินอิสระจะเผยผลทดสอบเฉพาะด้านไซเบอร์ ข้อสรุปที่แม่นยำที่สุดคือ โมเดลนี้น่าจับตาสำหรับงานป้องกันที่ถูกต้องตามกฎหมาย แต่ยังถูกปิดกั้นอย่างเข้มงวดและยังจัดอันดับเทียบกับโมเดลไซเบอร์อื่นไม่ได้จากข้อมูลสาธารณะที่มี