La risposta dipende da quale versione di GPT e da quale attività hai in mente. A metà 2026, diversi modelli superano specifiche versioni di GPT nei benchmark, ma nessun modello batte tutte le varianti GPT in ogni dimensione. Ecco la situazione aggiornata.
Quali modelli sono attualmente davanti a GPT?
Claude (Anthropic) — Claude Opus 4.8 è il modello generalista più forte attualmente disponibile, con un punteggio complessivo di 67,9 contro il 62,9 di GPT-5.5
. Claude Fable 5 guida il benchmark LM Council con l'81,9%
, mentre Claude Mythos 5 è in cima alla classifica composita con un punteggio di 99
.
Gemini (Google) — Gemini 3.1 Pro Preview guida la classifica LM Council 'senza strumenti' con il 46,4%, davanti a GPT-5.4 Pro con il 44,3%
. Al rilascio ha ottenuto i punteggi migliori in 13 dei 16 benchmark
, tra cui il top nel ragionamento (GPQA Diamond: 94,3%) e in matematica (AIME 2025: 95,0%)
.