Harga API terus GPT 5.6 Sol turun daripada AS$5 kepada AS$4 bagi setiap sejuta token input, manakala token output turun daripada AS$30 kepada AS$20. Potongan Sol lebih kecil berbanding Luna yang turun 80% dan Terra yang turun 20% pada Julai.
Research answer

Create a landscape editorial hero image for this Studio Global article: What changes did OpenAI make to GPT 5.6 Sol’s API and credit pricing, how does the reduction compare with the earlier GPT 5.6 Luna and Terra. Article summary: OpenAI has cut direct GPT‑5.6 Sol API pricing to $4/M short context input tokens and $20/M output tokens, from the earlier $5/M and $30/M—20% lower on input and about 33% lower on output.. Topic tags: general web, openai, ai, productivity, code. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thum
OpenAI menurunkan harga API terus GPT-5.6 Sol kepada AS$4 bagi setiap sejuta token input dan AS$20 bagi setiap sejuta token output, berbanding kadar sebelumnya AS$5 dan AS$30. Ini bersamaan pengurangan 20% untuk input dan kira-kira 33% untuk output. Bagi penggunaan konteks panjang, kad harga OpenAI menyenaraikan AS$8 untuk input dan AS$30 untuk output bagi setiap sejuta token.
Potongan ini turut meliputi kredit yang layak untuk produk ejen AI dan alat pengekodan OpenAI. Namun, harga langganan ChatGPT Pro, Plus dan Business tidak berubah berdasarkan laporan yang tersedia.
Pada Julai, OpenAI terlebih dahulu mengurangkan harga dua model yang lebih rendah dalam keluarga GPT-5.6:
Justeru, potongan terbaharu Sol lebih sederhana daripada pengurangan Luna, tetapi lebih besar pada kos output berbanding potongan Terra. Harga baharu Sol itu juga dinyatakan sebagai promosi yang tersedia sekurang-kurangnya sehingga 21 November 2026.
Sol ialah model mercu dalam keluarga GPT-5.6 kerana ia diletakkan pada tahap harga tertinggi dan dibezakan melalui keupayaan pemprosesan premium. Terra pula diposisikan sebagai pilihan produksi umum yang mengimbangi keupayaan, prestasi dan kos, manakala Luna menyasarkan tugasan berjumlah besar serta sensitif terhadap kependaman seperti pengelasan, peringkasan dan penghalaan.
Dalam erti kata lain, potongan harga tidak mengubah susunan produk OpenAI. Sol masih ditujukan kepada tugasan yang memerlukan keupayaan tertinggi, sementara Terra dan Luna lebih sesuai untuk aplikasi yang mengutamakan kos atau skala.
Harga yang dipaparkan OpenRouter untuk laluan GPT-5.6 Sol daripada OpenAI ialah sekitar AS$2 bagi setiap sejuta token input dan AS$10 bagi setiap sejuta token output—kira-kira separuh daripada kadar terus OpenAI yang baharu.
Perbezaan ini boleh menjadi penting ketika syarikat memilih saluran pembelian API. Namun, harga pengagregat seperti OpenRouter perlu dinilai dengan berhati-hati kerana ia mungkin khusus kepada laluan tertentu, promosi sementara, syarat bukan-BYOK atau perubahan harga pada platform. Ia tidak semestinya menjadi harga senarai sejagat yang kekal.
Amazon Bedrock pula menyenaraikan harga GPT-5.6 Sol yang berbeza mengikut kaedah penghalaan. Untuk konteks pendek, profil merentas rantau global berharga AS$5 input dan AS$30 output, manakala pemprosesan dalam rantau serta merentas geografi berharga AS$5.50 input dan AS$33 output bagi setiap sejuta token.
AWS memperluas akses GPT-5.6 Sol, Terra dan Luna pada titik akhir bedrock-runtime. Ketiga-tiga model itu kini boleh digunakan melalui Responses API, Converse API dan Chat Completions API, selain menyokong inferens merentas rantau secara geografi dan global.
Pilihan In-Region memastikan permintaan diproses dalam rantau AWS yang dipilih. Pada peringkat awal, Sol tersedia di US East (N. Virginia) dan US East (Ohio), manakala Terra dan Luna turut tersedia di US West (Oregon).
Pilihan ini sesuai untuk organisasi yang perlu mengehadkan pemprosesan kepada satu rantau atas sebab pematuhan atau keperluan operasi tertentu.
Dengan Geographic atau Geo cross-Region inference, Bedrock boleh menghantar permintaan kepada kapasiti dalam kawasan geografi yang ditetapkan—contohnya Amerika Syarikat, Kesatuan Eropah, Jepun atau Australia—tanpa terikat pada satu rantau AWS sahaja. Data masih dikekalkan dalam sempadan geografi yang dipilih, menjadikannya lebih sesuai untuk keperluan kediaman data pada peringkat kawasan.
Profil inferens berawalan global. boleh mengarahkan permintaan ke mana-mana rantau komersial AWS yang disokong, berdasarkan kapasiti masa nyata. Ini memberikan kumpulan kapasiti paling luas dan berpotensi membantu ketika permintaan melonjak atau satu rantau mengalami kesesakan.
Namun, laluan global mungkin tidak sesuai untuk organisasi yang diwajibkan memastikan data kekal dalam negara atau geografi tertentu.
AWS menyenaraikan kuota inferens merentas rantau sebanyak 10 juta token seminit bagi GPT-5.6 Sol untuk setiap rantau yang disokong. Kuota ini mengambil kira jumlah token input dan output merentas permintaan kepada API seperti Converse, ConverseStream, InvokeModel dan InvokeModelWithResponseStream.
Merentas keluarga Sol, Terra dan Luna, Bedrock turut mendokumenkan:
AWS juga menyediakan peringkat harga konteks pendek sebanyak 272,000 token.
Perkembangan ini menunjukkan persaingan model AI peringkat hadapan semakin beralih daripada soal “model mana paling hebat” kepada persoalan kos keseluruhan, kelajuan, kependaman, kapasiti dan fleksibiliti pembelian.
OpenAI sebelum ini mengaitkan pengurangan harga Luna dan Terra serta peningkatan kelajuan Sol dengan peningkatan nisbah harga-prestasi. Ini memberi gambaran bahawa kecekapan runtime dan inferens sedang diterjemahkan kepada harga pelanggan yang lebih rendah serta pilihan kelajuan premium—bukan hanya disimpan sebagai margin tambahan.
Bagi perusahaan, Amazon Bedrock menawarkan faedah yang melangkaui harga token semata-mata: pengebilan dan kawalan IAM dalam ekosistem AWS, pilihan antara pemprosesan satu rantau dengan penghalaan geografi, serta laluan pemulihan apabila kapasiti sesuatu rantau sesak atau terganggu.
Kesimpulannya, strategi pembelian terbaik bukan semata-mata memilih titik akhir paling murah. Syarikat perlu membandingkan OpenAI secara terus, Bedrock dan pengagregat selepas menyemak terma kontrak, pengendalian data, kesamaan versi model, had kadar, tingkah laku cache serta sama ada penghalaan merentas rantau memenuhi keperluan pematuhan.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Harga API terus GPT 5.6 Sol turun daripada AS$5 kepada AS$4 bagi setiap sejuta token input, manakala token output turun daripada AS$30 kepada AS$20.
Harga API terus GPT 5.6 Sol turun daripada AS$5 kepada AS$4 bagi setiap sejuta token input, manakala token output turun daripada AS$30 kepada AS$20. Potongan Sol lebih kecil berbanding Luna yang turun 80% dan Terra yang turun 20% pada Julai.
OpenRouter memaparkan harga serendah AS$2 input dan AS$10 output, tetapi kadar itu bergantung pada laluan serta promosi.