Perubahan ini berlaku segera untuk paket API standar, hanya sekitar tiga minggu setelah keluarga GPT-5.6 diluncurkan ke publik pada 9 Juli 2026 .
Luna diposisikan sebagai model GPT-5.6 yang paling cepat dan paling ekonomis, terutama untuk beban kerja bervolume tinggi. Berikut perbandingan tarifnya per 1 juta token :
| Komponen | Tarif lama | Tarif baru |
|---|---|---|
| Input | US$1,00 | US$0,20 |
| Cached input | US$0,25 | US$0,10 |
| Output | US$6,00 | US$1,20 |
Jika biaya input dan output dijumlahkan, tarif Luna menjadi sekitar US$1,40 per 1 juta token . Penurunan ini membuat Luna lebih menarik untuk aplikasi yang memproses permintaan dalam jumlah besar, seperti otomatisasi, layanan pelanggan, dan fitur AI yang digunakan secara terus-menerus.
Sebagai pembanding, tarif GPT-5.6 Terra turun dari US$2,50 menjadi US$2,00 per 1 juta token input, serta dari US$15 menjadi US$12 per 1 juta token output. Sementara itu, GPT-5.6 Sol tetap berada di US$5,00 untuk input dan US$30,00 untuk output per 1 juta token .
OpenAI memberikan dua alasan yang saling berkaitan: peningkatan efisiensi teknologi dan perubahan persaingan di pasar AI .
Dalam pengumuman resminya, OpenAI mengatakan peningkatan efisiensi di berbagai lapisan model—termasuk kode dan sistem pendukung—memungkinkannya menghadirkan “lebih banyak kecerdasan per dolar” . Perusahaan menyebut strategi ini sebagai upaya untuk terus mendorong batas rasio harga dan performa .
Sebagian peningkatan tersebut bahkan dikaitkan dengan kemampuan GPT-5.6 Sol untuk menulis ulang kernel kode produksi secara mandiri. OpenAI menyatakan langkah itu memangkas biaya penyajian model sebesar 20% . Pekerjaan pada tingkat kernel juga menurunkan biaya penyajian end-to-end sebesar 20%, sedangkan sejumlah eksperimen meningkatkan efisiensi pembuatan token lebih dari 15% .
Pemangkasan harga ini juga terjadi ketika perusahaan semakin ketat menilai pengeluaran AI. Banyak bisnis masih menunda penerapan model mahal karena belum melihat gambaran yang jelas tentang imbal hasil investasinya .
Di saat yang sama, model open-weight yang lebih murah dari perusahaan-perusahaan China menambah tekanan bagi OpenAI dan Anthropic untuk membuktikan bahwa harga yang lebih tinggi sepadan dengan kemampuan yang ditawarkan . Reuters juga melaporkan bahwa pelaku bisnis kini semakin mencermati belanja AI, meski OpenAI menekankan bahwa pemangkasan tersebut terutama dimungkinkan oleh peningkatan efisiensi .
CEO OpenAI Sam Altman merangkum arah perubahan ini melalui unggahan di X: “Kami ingin menawarkan keseimbangan harga dan kecerdasan terbaik di setiap tingkatan” .
Bagi developer, penurunan harga Luna dapat mengurangi biaya operasional aplikasi AI yang menangani volume permintaan tinggi. Model ini menjadi opsi yang lebih masuk akal ketika kecepatan dan efisiensi lebih penting daripada kemampuan tertinggi dari model flagship.
Perubahan tersebut juga tercermin dalam cara penggunaan Luna dan Terra dihitung terhadap langganan berbayar ChatGPT Work dan Codex. Artinya, pelanggan perusahaan berpotensi melakukan lebih banyak pekerjaan AI tanpa menambah biaya langganan .
Secara lebih luas, langkah OpenAI menunjukkan bahwa persaingan model AI kini tidak hanya ditentukan oleh kemampuan, tetapi juga oleh ongkos setiap token. Jika efisiensi terus meningkat dan biaya inference turun, developer akan memiliki lebih banyak ruang untuk membangun fitur AI yang sebelumnya terlalu mahal untuk dijalankan pada skala besar.