ไม่มีรายงานการค้นพบดังกล่าว แม้จะมีข่าวลือและการคาดเดา แต่ไม่มีแหล่งข้อมูลใดที่กล่าวถึงการค้นพบทางคณิตศาสตร์ ทฤษฎีบท หรือบทพิสูจน์ใหม่ๆ ที่ทำโดย GPT-5.6 ความสามารถของโมเดลถูกกล่าวถึงในแง่ของประสิทธิภาพการทำงานด้านการเขียนโค้ด ความปลอดภัยทางไซเบอร์ ชีววิทยา และงาน agentic เท่านั้น AOO ไม่มีแหล่งข้อมูลใดระบุถึงการค้นพบทางคณิตศาสตร์ใหม่
เบนช์มาร์กนี้ทดสอบความสามารถในการวางแผน การใช้เครื่องมือ และการทำงานแบบ agentic ใน command-line — ซึ่งถูกเรียกว่าเป็น "การทดสอบที่โหดร้าย" สำหรับความสามารถของโมเดลในการทำงานอัตโนมัติในสภาพแวดล้อมเทอร์มินัล Y คะแนนที่รายงาน:
| โมเดล | คะแนน Terminal-Bench 2.1 |
|---|---|
| GPT-5.6 Sol Ultra | 91.9% BI |
| GPT-5.6 Sol | 88.8% B |
| Claude Mythos 5 | 88.0% I |
| GPT-5.5 | 83.4% BI |
คะแนน 91.9% ของ Sol Ultra เป็นการก้าวกระโดดที่สำคัญ — สูงกว่าโมเดลที่ดีที่สุดของ Anthropic ราว 4 จุด百分点 และมากกว่า GPT-5.5 ถึง 8 จุด BI
OpenAI จัดอันดับโมเดล GPT-5.6 ทั้งสามรุ่นว่า "สูง" (High) ในทั้งความเสี่ยงด้านความปลอดภัยทางไซเบอร์และชีวภาพ แต่ไม่มีรุ่นใดเลยที่ข้ามเกณฑ์ "วิกฤต" (Critical) A
| โมเดล | ราคา Input ($/1M tok) | ราคา Output ($/1M tok) | บทบาท |
|---|---|---|---|
| GPT-5.6 Sol | $5.00 | $30.00 | เรือธง — การใช้เหตุผลซับซ้อน การเขียนโค้ด ความปลอดภัยทางไซเบอร์ งาน agentic ระยะยาว |
| GPT-5.6 Terra | $2.50 | $15.00 | สมดุล — ประสิทธิภาพเทียบเท่า GPT-5.5 ในราคาครึ่งเดียว |
| GPT-5.6 Luna | $1.00 | $6.00 | ปริมาณมาก — เร็วและคุ้มค่าที่สุดสำหรับการจำแนกประเภท การสกัดข้อมูล การจัดเส้นทาง |
OpenAI ยังได้แนะนำ prompt caching สำหรับ GPT-5.6 การเขียนแคชจะคิดค่าบริการ 1.25 เท่าของอัตรา input ที่ไม่มีการแคชของโมเดล ในขณะที่การอ่านแคชจะได้รับส่วนลด 90% สำหรับโทเค็น input ที่ถูกแคช GPT-5.6 รองรับการตั้งค่า cache breakpoints ที่ชัดเจนและอายุแคชขั้นต่ำ 30 นาที H
สาเหตุหลัก: การแทรกแซงโดยตรงจากรัฐบาลสหรัฐฯ รัฐบาลทรัมป์ร้องขอให้ OpenAI จำกัดการเข้าถึงก่อนการเปิดตัวอย่างชัดเจน โดยอ้างถึงความกังวลด้านความมั่นคงของชาติ TAK เจ้าหน้าที่ทำเนียบขาวอนุมัติองค์กรพันธมิตรที่ได้รับการคัดเลือกประมาณ 20 แห่งทีละราย AI
รัฐบาลพิจารณาว่า GPT-5.6 มีความสามารถ "ระดับ Mythos" — ซึ่งหมายถึง Claude Mythos ของ Anthropic ซึ่งรุ่นก่อนหน้า (Claude Fable 5) ถูกระงับการใช้งานทั่วโลกโดยกระทรวงพาณิชย์เมื่อวันที่ 12 มิถุนายน 2026 ภายใต้กฎการควบคุมการส่งออก A การจำกัด GPT-5.6 มาจากกรอบนโยบายเดียวกัน
OpenAI ระบุต่อสาธารณะว่าการควบคุมโดยรัฐบาลแบบนี้ "ทำให้เครื่องมือที่ดีที่สุดไม่สามารถเข้าถึงผู้ใช้ นักพัฒนา องค์กร ผู้ป้องกันไซเบอร์ และพันธมิตรทั่วโลกที่ต้องการมัน" A
OpenAI กล่าวว่า "วางแผนที่จะขยายการให้บริการโดยเร็วที่สุด" แต่ ยังไม่มีการประกาศวันเปิดให้บริการทั่วไป H Sam Altman กล่าวว่าเขาคาดว่าจะสามารถเข้าถึงได้ในวงกว้าง "ภายในไม่กี่สัปดาห์" A System card ของบริษัทระบุว่า: "เราเชื่อในการเข้าถึงในวงกว้าง และเราวางแผนที่จะทำให้ GPT-5.6 Sol, Terra และ Luna เปิดให้บริการทั่วไปในอีกไม่กี่สัปดาห์ข้างหน้า" D
สำหรับตอนนี้ โมเดล AI ที่ทรงพลังที่สุดเท่าที่ OpenAI เคยปล่อยออกมานั้น มีให้เฉพาะผู้ที่วอชิงตันอนุมัติเท่านั้น