Claude Fable 5, Opus 4.8, Sonnet 5, GPT-5.5, Grok 4.3 y Gemini 3.5 Flash: la guía definitiva de mediados de 2026
Claude Fable 5 lidera los benchmarks de código con un 95,0% en SWE bench Verified y un 80,3% en SWE bench Pro, a un precio de $10/$50 por millón de tokens. Grok 4.3 es la API cerrada más barata: solo $1,25 por millón de tokens de entrada y $2,50 por millón de salida, con un 98% en τ² Bench para tareas de agente.
Claude Fable 5 lidera los benchmarks de código con un 95,0% en SWE bench Verified y un 80,3% en SWE bench Pro, a un precio de $10/$50 por millón de tokens.
Grok 4.3 es la API cerrada más barata: solo $1,25 por millón de tokens de entrada y $2,50 por millón de salida, con un 98% en τ² Bench para tareas de agente.
Claude Sonnet 5 ofrece un precio promocional de $2/$10 por millón de tokens hasta el 31 de agosto de 2026, con un rendimiento cercano al Opus 4.8.
Los precios varían en un factor de 40x entre Grok 4.3 ($1,25 entrada) y GPT 5.5 Pro ($180 salida).
Research benchmarks & pricing of Claude Sonnet 5, Claude Fable 5, Claude Opus 4.8, GPT 5.5, Grok 4.3, Gemini 3.5, DeepSeek V4 ProFrontier AI model comparison: benchmark scores and API pricing across major providers as of mid-2026.
Prompt de IA
Create a landscape editorial hero image for this Studio Global article: Research benchmarks & pricing of Claude Sonnet 5, Claude Fable 5, Claude Opus 4.8, GPT 5.5, Grok 4.3, Gemini 3.5, DeepSeek V4 Pro. Compare t. Article summary: # Frontier AI Model Comparison: Benchmarks & Pricing (Mid-2026). Topic tags: deepresearch, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
openai.com
Elegir el modelo de IA adecuado a mediados de 2026 implica equilibrar los resultados en los benchmarks con los costes de API, en un ecosistema que se expande rápidamente. Esta guía compara Claude Fable 5, Claude Opus 4.8, Claude Sonnet 5, GPT-5.5, Grok 4.3 y Gemini 3.5 Flash utilizando únicamente fuentes verificadas. DeepSeek V4 Pro se incluye para completar la información, pero no se ha podido comparar de forma fiable debido a la ausencia de fuentes respaldadas en el conjunto de investigación proporcionado.
Precios de API (por millón de tokens)
La siguiente tabla muestra el coste bruto por token de cada modelo. Nótese que Claude Fable 5 cuesta exactamente el doble que Claude Opus 4.8, mientras que Grok 4.3 es, con diferencia, la opción más barata entre los modelos cerrados.
Modelo
Entrada ($/1M tok)
Salida ($/1M tok)
Entrada en caché
Claude Fable 5
$10,00
$50,00
Studio Global AI
Continúe su investigación
Esta página incluye una respuesta respaldada por fuentes que puede continuar dentro de Studio Global.
¿Cuál es la respuesta corta a "Claude Fable 5, Opus 4.8, Sonnet 5, GPT-5.5, Grok 4.3 y Gemini 3.5 Flash: la guía definitiva de mediados de 2026"?
Claude Fable 5 lidera los benchmarks de código con un 95,0% en SWE bench Verified y un 80,3% en SWE bench Pro, a un precio de $10/$50 por millón de tokens.
¿Cuáles son los puntos clave a validar primero?
Claude Fable 5 lidera los benchmarks de código con un 95,0% en SWE bench Verified y un 80,3% en SWE bench Pro, a un precio de $10/$50 por millón de tokens. Grok 4.3 es la API cerrada más barata: solo $1,25 por millón de tokens de entrada y $2,50 por millón de salida, con un 98% en τ² Bench para tareas de agente.
¿Qué debo hacer a continuación en la práctica?
Claude Sonnet 5 ofrece un precio promocional de $2/$10 por millón de tokens hasta el 31 de agosto de 2026, con un rendimiento cercano al Opus 4.8.
Claude Sonnet 5 ofrece un descuento promocional hasta el 31 de agosto de 2026: $2 por millón de tokens de entrada y $10 por millón de tokens de salida . A partir de esa fecha, el precio sube a $3/$15.
Principales resultados en benchmarks
La tabla de benchmarks es intencionadamente escueta; solo se incluyen los datos que aparecen explícitamente en las fuentes proporcionadas:
Benchmark
Claude Fable 5
Claude Opus 4.8
GPT-5.5
Grok 4.3
SWE-bench Verified
95,0%
—
—
—
SWE-bench Pro
80,3%
69,2%
~58%
—
AA Intelligence Index
—
—
—
53
τ²-Bench (agente)
—
—
—
98%
Cronología de lanzamiento
Conocer cuándo estuvo disponible cada modelo ayuda a contextualizar las afirmaciones de liderazgo en los benchmarks:
Modelo
Fecha de lanzamiento / disponibilidad
Proveedor
Claude Fable 5
9 de junio de 2026
Anthropic
Claude Opus 4.8
28 de mayo de 2026 (referenciado en materiales de Fable 5)
Anthropic
Claude Sonnet 5
30 de junio de 2026, con precios promocionales hasta el 31 de agosto de 2026
Anthropic
GPT-5.5
23 de abril de 2026
OpenAI
Grok 4.3
30 de abril de 2026
xAI
Gemini 3.5 Flash
19 de mayo de 2026
Google
DeepSeek V4 Pro
No hay detalles de lanzamiento verificados en las fuentes proporcionadas
DeepSeek
Lo que mejor sabe hacer cada modelo
Claude Fable 5: El líder en código
Claude Fable 5 obtiene las puntuaciones más altas en benchmarks de código de esta comparativa: 95,0% en SWE-bench Verified y 80,3% en SWE-bench Pro . Con un precio de $10/$50 por millón de tokens, cuesta exactamente el doble que Opus 4.8, pero ofrece una mejora relativa del 16% en SWE-bench Pro (80,3% frente a 69,2%) . Es la mejor opción para equipos que necesiten el máximo rendimiento verificado en programación y tengan el presupuesto para ello.
Claude Opus 4.8: El buque insignia fiable
A $5/$25 por millón de tokens, Opus 4.8 sigue siendo el principal punto de comparación en los benchmarks para Fable 5 en las fuentes proporcionadas . Obtiene un 69,2% en SWE-bench Pro, un resultado sólido para su categoría de precio . Un nuevo modo rápido (Fast Mode) funciona 2,5 veces más rápido por $10/$50 por millón de tokens . Ideal para usuarios que necesitan la calidad estándar de Opus sin la prima de Fable.
Claude Sonnet 5: La máquina de trabajo rentable
Sonnet 5 ofrece resultados en benchmarks cercanos a los de Claude Opus 4.8, según sus materiales de origen . Su precio promocional de $2/$10 por millón de tokens hasta el 31 de agosto de 2026 lo convierte en la opción Claude más barata para trabajos de gran volumen . Tras el periodo promocional, el precio sube a $3/$15, una tarifa aún competitiva dada su proximidad al rendimiento de la clase Opus. Lo mejor para equipos que quieran una calidad casi de buque insignia a una fracción del coste.
GPT-5.5: La opción equilibrada
GPT-5.5 tiene un precio de $5/$30 por millón de tokens, con una variante Pro premium a $30/$180 . Las fuentes proporcionadas confirman los precios de su API, pero no respaldan algunas puntuaciones concretas en benchmarks. Es la mejor opción para equipos ya integrados en el ecosistema de OpenAI.
Grok 4.3: El modelo frontera de bajo coste
A $1,25/$2,50 por millón de tokens, Grok 4.3 es la opción de API cerrada más barata de esta tabla . Obtiene una puntuación de 53 en el Artificial Analysis Intelligence Index y alcanza el 98% en τ²-Bench para uso de herramientas de agente . Un importante recorte de precios —del 37,5% en entrada y del 58,3% en salida— lo convierte en la opción obvia para cargas de trabajo sensibles al coste. Lo mejor para aplicaciones de alto volumen donde el uso de herramientas de agente sea importante y el presupuesto sea la principal limitación.
Gemini 3.5 Flash: Velocidad y valor
Con un precio de $1,50/$9,00 por millón de tokens, Gemini 3.5 Flash ofrece inteligencia de frontera con velocidad y fundamentación . El almacenamiento en caché de contexto cuesta solo $0,15 por millón de tokens . Es ideal para aplicaciones que necesitan un rendimiento de razonamiento rápido sin la etiqueta de precio de los modelos insignia.
DeepSeek V4 Pro: No comparable aquí
No se ha incluido ninguna fuente específica sobre precios o benchmarks de DeepSeek en el conjunto de investigación proporcionado. Cualquier afirmación sobre DeepSeek V4 Pro debe verificarse con fuentes separadas y dedicadas antes de tomar decisiones.
Lo que sigue siendo incierto
La cobertura de benchmarks de Fable 5 se limita a las fuentes centradas en Fable, que reportan un 95,0% en SWE-bench Verified y un 80,3% en SWE-bench Pro .
El precio de Gemini 3.5 Pro no está cubierto por las fuentes proporcionadas, que solo respaldan el precio de Gemini 3.5 Flash .
Las cifras exactas de los benchmarks de Sonnet 5 no se publican en su totalidad en las fuentes proporcionadas. Una fuente afirma que sus resultados son cercanos a los de Claude Opus 4.8, pero no proporciona la tabla completa necesaria para verificar las cifras exactas .
Los precios y benchmarks de DeepSeek V4 Pro se excluyeron de las tablas cuantitativas porque las fuentes proporcionadas no respaldan las afirmaciones originales.