Harga langsung API GPT 5.6 Sol turun menjadi US$4 per 1 juta token input dan US$20 per 1 juta token output untuk konteks pendek, dari sebelumnya US$5 dan US$30. Pemangkasan Sol lebih kecil dibanding Luna yang turun 80% dan Terra yang turun 20% pada Juli.
Jawaban penelitian

Create a landscape editorial hero image for this Studio Global article: What changes did OpenAI make to GPT 5.6 Sol’s API and credit pricing, how does the reduction compare with the earlier GPT 5.6 Luna and Terra. Article summary: OpenAI has cut direct GPT‑5.6 Sol API pricing to $4/M short context input tokens and $20/M output tokens, from the earlier $5/M and $30/M—20% lower on input and about 33% lower on output.. Topic tags: general web, openai, ai, productivity, code. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thum
OpenAI memangkas harga langsung API GPT-5.6 Sol menjadi US$4 per 1 juta token input dan US$20 per 1 juta token output untuk penggunaan dengan konteks pendek. Sebelumnya, tarifnya adalah US$5 untuk input dan US$30 untuk output. Artinya, biaya input turun 20%, sedangkan biaya output berkurang sekitar 33%. Untuk konteks panjang, OpenAI mencantumkan tarif US$8 per 1 juta token input dan US$30 per 1 juta token output.
Harga baru tersebut berlaku untuk API dan kredit yang memenuhi syarat, bukan untuk tarif langganan ChatGPT Pro, Plus, atau Business. OpenAI menyebut harga promosi Sol tersedia setidaknya hingga 21 November 2026.
Pemangkasan Sol datang setelah OpenAI lebih dulu menurunkan harga dua model lain dalam keluarga GPT-5.6 pada Juli:
| Model | Harga input baru | Harga output baru | Perubahan |
|---|---|---|---|
| GPT-5.6 Sol | US$4 | US$20 | Turun 20% untuk input, sekitar 33% untuk output |
| GPT-5.6 Terra | US$2 | US$12 | Turun 20% |
| GPT-5.6 Luna | US$0,20 | US$1,20 | Turun 80% |
Semua harga dihitung per 1 juta token untuk konteks pendek. Luna tetap ditujukan bagi pekerjaan bervolume tinggi dan sensitif terhadap latensi, sedangkan Terra diposisikan sebagai pilihan produksi yang menyeimbangkan kemampuan, kecepatan, dan biaya.
Dengan demikian, penurunan Sol tidak sedrastis Luna. Namun, karena Sol merupakan model dengan harga tertinggi di keluarga tersebut, pengurangan biaya output dari US$30 menjadi US$20 dapat berdampak besar pada aplikasi yang menghasilkan banyak token, seperti agen AI, pemrograman, dan alur kerja penalaran panjang.
Sol tetap menjadi model flagship atau kelas teratas OpenAI karena menawarkan tingkat kemampuan dan kapasitas premium dalam keluarga GPT-5.6. Terra berfokus pada keseimbangan biaya dan performa untuk penggunaan umum, sementara Luna dirancang untuk skenario cepat dan bervolume besar.
OpenAI sebelumnya memperkenalkan Fast mode untuk Sol. Mode ini dapat memberikan kecepatan hingga 2,5 kali pemrosesan Standard dengan tarif dua kali lipat, tanpa mengubah tingkat kecerdasan model. Jadi, strategi Sol bukan hanya menurunkan harga dasar, tetapi juga memberi pilihan bagi pelanggan yang lebih memprioritaskan latensi.
Langkah tersebut menunjukkan bahwa peningkatan efisiensi inference—proses menjalankan model untuk menghasilkan jawaban—mulai diteruskan kepada pelanggan dalam bentuk harga lebih rendah dan pilihan kecepatan. Efisiensi tidak hanya dipertahankan sebagai margin bagi penyedia model.
OpenRouter saat ini menampilkan GPT-5.6 Sol dengan harga sekitar US$2 per 1 juta token input dan US$10 per 1 juta token output. Tarif itu kira-kira separuh dari harga langsung OpenAI yang baru.
Namun, harga di aggregator seperti OpenRouter perlu dibaca sebagai harga berdasarkan rute tertentu. Tarif dapat dipengaruhi oleh promosi, jenis trafik, dukungan caching, atau ketentuan non-BYOK—bukan berarti OpenAI telah menetapkan harga universal sebesar US$2 dan US$10 untuk seluruh kanal.
Amazon Bedrock juga memiliki struktur harga berbeda berdasarkan cara permintaan dirutekan. Untuk konteks pendek, tarif GPT-5.6 Sol di Bedrock adalah:
Untuk konteks panjang hingga 1 juta token, harga global yang tercantum adalah US$10 untuk input dan US$45 untuk output per 1 juta token.
Karena itu, endpoint termurah belum tentu menjadi pilihan terbaik. Pembeli perusahaan juga perlu membandingkan biaya AWS, kontrol akses, batas laju, kebijakan data, caching, kesetaraan versi model, serta persyaratan kontrak.
AWS memperluas GPT-5.6 Sol, Terra, dan Luna di endpoint bedrock-runtime. Ketiganya kini dapat digunakan melalui API Responses, Converse, dan Chat Completions, sekaligus mendukung inference lintas wilayah secara geografis maupun global.
Pada mode In-Region, pemrosesan tetap berada di AWS Region yang dipilih. Saat ketersediaan awal diumumkan, Sol tersedia di US East (N. Virginia) dan US East (Ohio). Terra dan Luna juga tersedia di US West (Oregon).
Mode geographic, atau Geo cross-Region, memungkinkan Bedrock mengirim permintaan ke kapasitas di dalam wilayah geografis yang telah ditentukan, misalnya Amerika Serikat, Uni Eropa, Jepang, atau Australia. Permintaan tidak harus terkunci pada satu Region, tetapi tetap dibatasi pada geografi tertentu untuk membantu kebutuhan residensi data.
Mode global menggunakan inference profile dengan awalan global.. Bedrock dapat mengarahkan permintaan ke AWS Region komersial mana pun yang didukung, berdasarkan kapasitas secara real time. Opsi ini menyediakan kumpulan kapasitas terbesar dan dapat membantu ketika terjadi lonjakan permintaan.
Konsekuensinya, mode global kurang cocok untuk organisasi yang mewajibkan data diproses hanya di negara atau geografi tertentu. Dalam situasi tersebut, In-Region atau Geo cross-Region lebih sesuai, meskipun tarifnya dapat lebih tinggi.
AWS mencantumkan kuota inference cross-Region GPT-5.6 Sol sebesar 10 juta token per menit di setiap Region yang didukung. Kuota ini menghitung gabungan token input dan output dari berbagai permintaan inference.
Di Bedrock, keluarga Sol, Terra, dan Luna mendukung input teks dan gambar, output teks, prompt caching, serta jendela konteks hingga 1 juta token. AWS juga mencantumkan tier harga konteks pendek sebesar 272 ribu token.
Perubahan ini memperlihatkan bahwa persaingan model frontier semakin bergeser dari sekadar kemampuan mentah ke biaya total, throughput, latensi, dan fleksibilitas pengadaan. OpenAI lebih dulu memangkas harga Luna dan Terra secara agresif, lalu menurunkan harga Sol setelah kanal alternatif menawarkan tarif yang lebih rendah.
Bagi perusahaan, pilihan kini tidak terbatas pada membeli langsung dari OpenAI. OpenRouter dapat menawarkan akses melalui satu lapisan routing, sedangkan Bedrock menyediakan penagihan AWS, kontrol IAM, pilihan lokasi pemrosesan, serta jalur pengalihan otomatis ketika kapasitas di satu Region bermasalah.
Pendekatan yang paling aman bukan sekadar memilih endpoint dengan harga token terendah. Sebelum memindahkan beban kerja, perusahaan sebaiknya menguji:
Dengan kata lain, perang harga GPT-5.6 membuat biaya inference turun, tetapi keputusan pengadaan AI menjadi semakin teknis. Harga token hanyalah satu bagian dari tagihan dan risiko operasional secara keseluruhan.
Studio Global AI
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
Harga langsung API GPT 5.6 Sol turun menjadi US$4 per 1 juta token input dan US$20 per 1 juta token output untuk konteks pendek, dari sebelumnya US$5 dan US$30.
Harga langsung API GPT 5.6 Sol turun menjadi US$4 per 1 juta token input dan US$20 per 1 juta token output untuk konteks pendek, dari sebelumnya US$5 dan US$30. Pemangkasan Sol lebih kecil dibanding Luna yang turun 80% dan Terra yang turun 20% pada Juli.
OpenRouter menampilkan harga Sol US$2 untuk input dan US$10 untuk output per 1 juta token, tetapi harga ini bergantung pada rute dan promosi yang berlaku.