Đây là bài kiểm tra khả năng lập kế hoạch, sử dụng công cụ và tác nhân tự động trên dòng lệnh — một bài kiểm tra "khắc nghiệt" về khả năng vận hành tự chủ của mô hình trong môi trường terminal Y. Kết quả cụ thể:
| Mô hình | Điểm Terminal-Bench 2.1 |
|---|---|
| GPT-5.6 Sol Ultra | 91,9% BI |
| GPT-5.6 Sol | 88,8% B |
| Claude Mythos 5 | 88,0% I |
| GPT-5.5 | 83,4% BI |
Sol Ultra đạt 91,9% — một bước nhảy vọt, vượt hơn mô hình mạnh nhất của Anthropic (Anthropic là một công ty AI đối thủ của OpenAI) khoảng 4 điểm phần trăm và hơn GPT-5.5 hơn 8 điểm BI.
OpenAI xếp hạng cả ba mô hình GPT-5.6 ở mức "Cao" về cả rủi ro an ninh mạng và sinh học, nhưng không mô hình nào vượt ngưỡng "Nguy kịch" A.
| Mô hình | Đầu vào ($/1 triệu token) | Đầu ra ($/1 triệu token) | Vai trò |
|---|---|---|---|
| GPT-5.6 Sol | 5,00$ | 30,00$ | Flagship — suy luận phức tạp, lập trình, an ninh mạng, tác vụ tác nhân dài hạn |
| GPT-5.6 Terra | 2,50$ | 15,00$ | Cân bằng — ngang GPT-5.5 với giá chỉ bằng một nửa |
| GPT-5.6 Luna | 1,00$ | 6,00$ | Khối lượng lớn — nhanh và tiết kiệm nhất cho phân loại, trích xuất, định tuyến |
OpenAI cũng giới thiệu tính năng lưu đệm (caching) cho GPT-5.6. Ghi vào bộ nhớ đệm được tính phí gấp 1,25 lần tỷ lệ đầu vào không lưu đệm, trong khi đọc từ bộ nhớ đệm được giảm 90% trên các token đã lưu. GPT-5.6 hỗ trợ điểm dừng bộ nhớ đệm rõ ràng và thời gian tồn tại tối thiểu 30 phút H.
Lý do chính: Can thiệp trực tiếp từ chính phủ Mỹ. Chính quyền Trump đã yêu cầu OpenAI hạn chế quyền truy cập trước khi phát hành, với lý do an ninh quốc gia TAK. Các quan chức Nhà Trắng đã đích thân phê duyệt từng tổ chức đối tác trong số khoảng 20 tổ chức được cấp quyền AI.
Chính quyền coi GPT-5.6 có khả năng "ngang với Mythos" — ám chỉ Claude Mythos của Anthropic, mà người tiền nhiệm của nó (Claude Fable 5) đã bị Bộ Thương mại Mỹ buộc đình chỉ hoạt động trên toàn thế giới vào ngày 12 tháng 6 năm 2026 theo quy định kiểm soát xuất khẩu A. Hạn chế đối với GPT-5.6 nằm trong cùng khuôn khổ chính sách này.
OpenAI cho biết họ "dự định mở rộng quyền truy cập càng sớm càng tốt" nhưng chưa công bố ngày phát hành công khai H. Sam Altman, CEO của OpenAI, tuyên bố kỳ vọng quyền truy cập rộng hơn "trong vòng vài tuần" A. Tài liệu System Card của công ty viết: "Chúng tôi tin vào quyền truy cập rộng rãi và có kế hoạch tung ra GPT-5.6 Sol, Terra và Luna trong những tuần tới" D.
Hiện tại, mô hình AI mạnh nhất từng được OpenAI phát hành chỉ dành cho những đơn vị được Washington chấp thuận.