| — |
| Claude Opus 4.8 | 5,00 $ | 25,00 $ | — |
| Claude Sonnet 5 (introd. → 1 set '26) | 2,00 $ → 3,00 $ | 10,00 $ → 15,00 $ | 0,20 $ → 0,30 $ |
| GPT-5.5 | 5,00 $ | 30,00 $ | 0,50 $ |
| GPT-5.5 Pro | 30,00 $ | 180,00 $ | — |
| Grok 4.3 | 1,25 $ | 2,50 $ | — |
| Gemini 3.5 Flash | 1,50 $ | 9,00 $ | 0,15 $ |
| DeepSeek V4 Pro | — | — | — |
Claude Sonnet 5 offre uno sconto di lancio fino al 31 agosto 2026: 2$ per milione di token in input e 10$ per milione di token in output. Dopo tale data, i prezzi salgono a 3$/15$.
La tabella è volutamente essenziale: include solo i dati esplicitamente presenti nelle fonti fornite.
| Benchmark | Claude Fable 5 | Claude Opus 4.8 | GPT-5.5 | Grok 4.3 |
|---|---|---|---|---|
| SWE-bench Verified | 95,0% | — | — | — |
| SWE-bench Pro | 80,3% | 69,2% | ~58% | — |
| AA Intelligence Index | — | — | — | 53 |
| τ²-Bench (agentico) | — | — | — | 98% |
Sapere quando ogni modello è diventato disponibile aiuta a contestualizzare le affermazioni di leadership nei benchmark.
Claude Fable 5 vanta i punteggi più alti nei benchmark di coding: 95% su SWE-bench Verified e 80,3% su SWE-bench Pro. Al costo di 10$/50$ per milione di token, è esattamente il doppio di Opus 4.8, ma offre un miglioramento relativo del 16% su SWE-bench Pro (80,3% contro 69,2%).
Ideale per team che cercano le massime prestazioni verificate nel coding e hanno il budget per ottenerle.
A 5$/25$ per milione di token, Opus 4.8 rimane il principale punto di riferimento per Fable 5 nelle fonti fornite. Ottiene il 69,2% su SWE-bench Pro, un risultato solido per la sua fascia di prezzo.
La nuova modalità Fast funziona a 2,5x la velocità per 10$/50$ per milione di token.
Ideale per chi necessita della qualità standard di Opus senza il sovrapprezzo di Fable.
Sonnet 5 offre prestazioni vicine a Claude Opus 4.8, secondo le sue fonti di presentazione. Il prezzo di lancio di 2$/10$ per milione di token (fino al 31 agosto 2026) lo rende l'opzione Claude più economica per volumi elevati.
Dopo il periodo promozionale, il prezzo sale a 3$/15$, comunque competitivo data la sua prossimità alle prestazioni di Opus. Ideale per team che vogliono una qualità quasi da ammiraglia a una frazione del costo.
GPT-5.5 costa 5$/30$ per milione di token, con una variante premium Pro a 30$/180$. Le fonti fornite ne confermano i prezzi API ma non supportano alcuni punteggi benchmark dichiarati (come Terminal-Bench 2.0 o AA Intelligence Index). Ideale per team già integrati nell'ecosistema OpenAI.
A 1,25$/2,50$ per milione di token, Grok 4.3 è l'opzione API proprietaria più economica della tabella. Ottiene un punteggio di 53 nell'Artificial Analysis Intelligence Index e raggiunge il 98% su τ²-Bench per l'uso agentico di strumenti.
Un taglio di prezzo significativo — 37,5% sull'input e 58,3% sull'output — lo rende la scelta ovvia per carichi di lavoro sensibili al costo. Ideale per applicazioni ad alto volume dove l'uso agentico di strumenti è importante e il budget è il vincolo principale.
Al prezzo di 1,50$/9,00$ per milione di token, Gemini 3.5 Flash offre intelligenza di frontiera con velocità e grounding. Il context caching costa solo 0,15$ per milione di token.
Ideale per applicazioni che necessitano di rapide capacità di ragionamento senza il prezzo delle ammiraglie.
Nessuna fonte specifica su prezzi o benchmark DeepSeek è stata inclusa nel set di ricerca fornito. Qualsiasi affermazione su DeepSeek V4 Pro dovrebbe essere verificata con fonti dedicate e separate prima di prendere decisioni.