Claude Fable 5 mendahului penanda aras pengekodan dengan 95.0% pada SWE bench Verified dan 80.3% pada SWE bench Pro, pada harga $10/$50 per juta token. Julat harga API adalah besar: Grok 4.3 ($1.25 input) paling murah, manakala GPT 5.5 Pro ($180 output) paling mahal, hampir 40x ganda.
Research answer

Create a landscape editorial hero image for this Studio Global article: Research benchmarks & pricing of Claude Sonnet 5, Claude Fable 5, Claude Opus 4.8, GPT 5.5, Grok 4.3, Gemini 3.5, DeepSeek V4 Pro. Compare t. Article summary: # Frontier AI Model Comparison: Benchmarks & Pricing (Mid-2026). Topic tags: deepresearch, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
Memilih model AI yang tepat pada pertengahan 2026 memerlukan keseimbangan antara skor penanda aras dan kos API dalam pilihan yang kian berkembang. Panduan ini membandingkan Claude Fable 5, Claude Opus 4.8, Claude Sonnet 5, GPT-5.5, Grok 4.3, dan Gemini 3.5 Flash menggunakan hanya sumber yang telah disahkan. DeepSeek V4 Pro disenaraikan untuk tujuan lengkap tetapi tidak boleh dibandingkan dengan pasti di sini kerana ketiadaan sumber yang disokong dalam set penyelidikan yang disediakan.
Jadual harga di bawah menunjukkan kos token mentah bagi setiap model. Perhatikan bahawa Claude Fable 5 berharga dua kali ganda berbanding Claude Opus 4.8, manakala Grok 4.3 memotong harga model tertutup lain dengan jauh.
Claude Sonnet 5 menawarkan diskaun pengenalan sehingga 31 Ogos 2026: $2 per juta token input dan $10 per juta token output. Selepas tarikh itu, harga meningkat kepada $3/$15.
Jadual penanda aras sengaja dihadkan — hanya data yang jelas terdapat dalam sumber yang disediakan telah dimasukkan:
| Penanda Aras | Claude Fable 5 | Claude Opus 4.8 | GPT-5.5 | Grok 4.3 |
|---|---|---|---|---|
| SWE-bench Verified | 95.0% | — | — | — |
| SWE-bench Pro | 80.3% | 69.2% | ~58% | — |
| AA Intelligence Index | — | — | — | 53 |
| τ²-Bench (ejen) | — | — | — | 98% |
Mengetahui bila setiap model tersedia membantu memahami dakwaan kepimpinan penanda aras:
Claude Fable 5 memegang skor penanda aras pengekodan tertinggi dalam perbandingan ini: 95.0% pada SWE-bench Verified dan 80.3% pada SWE-bench Pro. Pada $10/$50 per juta token, ia berharga dua kali ganda berbanding Opus 4.8 tetapi memberikan peningkatan relatif 16% pada SWE-bench Pro (80.3% vs 69.2%).
Terbaik untuk pasukan yang memerlukan prestasi pengekodan maksimum dan mempunyai bajet untuk dipadankan.
Pada $5/$25 per juta token, Opus 4.8 kekal sebagai titik perbandingan penanda aras utama untuk Fable 5 dalam sumber yang disediakan. Ia mencapai 69.2% pada SWE-bench Pro, keputusan yang kukuh untuk julat harganya.
Mod Pantas baharu berjalan pada kelajuan 2.5x dengan harga $10/$50 per juta token.
Terbaik untuk pengguna yang memerlukan kualiti Opus standard tanpa premium Fable.
Sonnet 5 memberikan skor penanda aras yang hampir dengan Claude Opus 4.8, menurut sumbernya. Harga pengenalannya $2/$10 per juta token sehingga 31 Ogos 2026 menjadikannya pilihan Claude termurah untuk kerja volum tinggi.
Selepas tempoh pengenalan, harga meningkat kepada $3/$15 — masih kompetitif memandangkan prestasinya yang hampir setanding Opus. Terbaik untuk pasukan yang mahukan kualiti hampir andalan pada sebahagian kecil daripada kos.
GPT-5.5 berharga $5/$30 per juta token, dengan varian Pro premium pada $30/$180. Sumber yang disediakan mengesahkan harga APInya tetapi tidak menyokong beberapa skor penanda aras yang didakwa (seperti Terminal-Bench 2.0 atau AA Intelligence Index). Terbaik untuk pasukan yang sudah bersepadu dalam ekosistem OpenAI.
Pada $1.25/$2.50 per juta token, Grok 4.3 adalah pilihan API model tertutup termurah dalam jadual ini. Ia mencapai 53 pada Indeks Kepintaran Analisis Buatan dan 98% pada τ²-Bench untuk penggunaan alat ejen.
Potongan harga yang ketara — 37.5% pada input dan 58.3% pada output — menjadikannya pilihan yang jelas untuk beban kerja yang sensitif kos. Terbaik untuk aplikasi volum tinggi di mana penggunaan alat ejen penting dan bajet adalah kekangan utama.
Berharga $1.50/$9.00 per juta token, Gemini 3.5 Flash menawarkan kecerdasan sempadan dengan kelajuan dan pengasasan. Cache konteks berharga hanya $0.15 per juta token.
Terbaik untuk aplikasi yang memerlukan prestasi penaakulan pantas tanpa tanda harga yang mahal.
Tiada sumber harga atau penanda aras khusus DeepSeek yang disertakan dalam set penyelidikan yang disediakan. Sebarang dakwaan tentang DeepSeek V4 Pro harus disahkan terhadap sumber berasingan yang khusus sebelum membuat keputusan.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Claude Fable 5 mendahului penanda aras pengekodan dengan 95.0% pada SWE bench Verified dan 80.3% pada SWE bench Pro, pada harga $10/$50 per juta token.
Claude Fable 5 mendahului penanda aras pengekodan dengan 95.0% pada SWE bench Verified dan 80.3% pada SWE bench Pro, pada harga $10/$50 per juta token. Julat harga API adalah besar: Grok 4.3 ($1.25 input) paling murah, manakala GPT 5.5 Pro ($180 output) paling mahal, hampir 40x ganda.
Setiap model mempunyai kekuatan unik: Claude Fable 5 untuk pengekodan, Grok 4.3 untuk tugas ejen, dan Gemini 3.5 Flash untuk kelajuan dan nilai.