El mejor modelo del mundo dejó de existir el 12 de junio de 2026, tres días después de salir, cuando el gobierno de Estados Unidos ordenó a Anthropic suspender Claude Fable 5. Su marcha no dejó un sucesor: dejó un empate. Esta clasificación va de lo que queda, y de cuál de esos empatados merece tu dinero.
Actualización del 4 de septiembre de 2026. Fable 5 volvió el 2 de julio con nuevas salvaguardas, así que la premisa de este artículo —el vacío en la cúspide— dejó de ser cierta pocas semanas después de publicarse. Los niveles y precios de más abajo describen junio de 2026 y se conservan como tal. La vuelta se cuenta en Fable 5 vuelve con nuevas salvaguardas.
Lo que sigue evalúa cada modelo por razonamiento, contexto, capacidad de programación y lo que cuesta, con el corte del 19 de junio de 2026.
El hueco que dejó Fable 5
Fable 5, junto a su hermano sin restricciones Mythos 5, marcaba 60 en el Artificial Analysis Intelligence Index v4.1 —que agrega nueve evaluaciones, entre ellas Terminal-Bench v2.1, Humanity’s Last Exam, GPQA Diamond y recuperación de contexto largo—, cuatro puntos por encima de todo lo demás. Cuatro puntos, en ese índice, no es un matiz.
El cierre cogió a la industria a contrapié. Anthropic discute la gravedad del jailbreak que disparó la directiva de control de exportaciones, y en el momento de escribir esto ambos modelos siguen fuera sin fecha de vuelta.
El efecto práctico es una cúspide comprimida: varios modelos que rondan los 55 se reparten un puesto que antes tenía dueño.
Los niveles
Sólo entran modelos que se pueden usar hoy y desplegar hoy.
Nivel S: lo mejor que puedes usar de verdad
Claude Opus 4.8 (56). El buque insignia de Anthropic manda en el grupo. Con 200K de contexto, obediencia a las instrucciones muy por encima de la media e integración con Claude Code, brilla en análisis complejo, escritura estructurada e ingeniería de software. Es caro —unos 3,25 $ por tarea del conjunto de Artificial Analysis— y hasta el plan Max (100–200 $/mes) tiene límites. Cuando la tarea exige la máxima inteligencia disponible, sigue siendo la referencia.
GPT-5.5 Pro «Spud» (55). Salió el 23 de abril de 2026 y es el mejor razonador puro que se puede comprar: 82,7% en Terminal-Bench 2.0, 71,4% de aprobado en las tareas cibernéticas del AISI —lo más alto del sector— y 51,7% en FrontierMath Tier 1–3. Va incluido en ChatGPT Plus (20 $/mes) y Pro (200 $/mes); por API, ~2,78 $ por tarea. Para matemáticas, ciencia y razonamiento en varios pasos no hay nada mejor.
Nivel A: donde está el dinero bien gastado
Claude Sonnet 4.6 (~51). Publicado el 17 de febrero de 2026, es la mejor relación entre lo que da y lo que cuesta de todo el mercado: alrededor del 90% de la calidad de Opus 4.8 por cerca del 30% del precio de API (~1,50 $ por tarea). Con 200K de contexto, Claude Code, uso de ordenador y artefactos, es el compañero diario razonable. Entra en el plan Pro de 20 $/mes.
GLM-5.2 (51,09). El momento que el código abierto llevaba años buscando. De Zhipu AI, es un MoE de 753B parámetros (40B activos) con licencia MIT —sin letra pequeña— y un millón de tokens de contexto. Gana a GPT-5.5 Pro en varios benchmarks de programación de horizonte largo: SWE-bench Pro (62,1 frente a 58,6), FrontierSWE Dominance (74,4 frente a 72,6) y AIME 2026 (99,2 frente a 98,3). Y lo hace por una sexta parte del coste (~0,46 $ por tarea frente a 2,78 $). Está en Fireworks, DeepInfra, Together y Groq, o te lo alojas tú. Para quien mire la factura, es el lanzamiento del año.
Nivel B: capaces y baratos
DeepSeek V4 Pro (44,27). Pesos abiertos, razonamiento sólido y 0,048 $ por tarea, el coste más bajo de toda la lista. Por API ronda 0,28 $/M de entrada y 1,10 $/M de salida. Se queda por detrás de GLM-5.2 en tareas agénticas y de horizonte largo, pero en producción con presupuesto corto no tiene rival en eficiencia.
MiniMax M3 (44,44). Un pelo por delante de DeepSeek V4 Pro en el índice, con posicionamiento y precios equivalentes. La diferencia es tan pequeña que lo sensato es elegir por cuál tenga mejor disponibilidad de API donde estés.
Nivel C: para lo que no requiere pensar
GPT-5 (~44). El modelo de agosto de 2025 es hoy la opción económica: pulido, disponible en todas partes e incluido en el nivel gratuito de ChatGPT. Buen respaldo, pero la distancia con GPT-5.5 Pro se nota.
Gemini 3.5 Flash (~40). La opción barata de Google, interesante sobre todo por su ventana de contexto —hasta 1M de tokens, según se le atribuye— y por el precio (~0,25–0,75 $/M combinado). Sirve para analizar documentos y clasificar en volumen. No sirve para razonar.
Claude Haiku 4.5 (~42). Rápido, barato (1–1,50 $/M combinado) y disponible en el nivel gratuito de Claude. Vale para generar código simple, para linting y para clasificar. No es un modelo sobre el que montar un producto.
Lo que cuesta cada cosa
| Suscripción | Precio | Mejor modelo incluido |
|---|---|---|
| ChatGPT Plus | 20 $/mes | GPT-5.5 (estándar) |
| Claude Pro | 20 $/mes | Sonnet 4.6, Opus 4.8 (limitado) |
| Gemini Advanced | ~20 $/mes | Gemini 3.5 Pro / Flash |
| Claude Max | ~100–200 $/mes | Opus 4.8 (sin límite práctico) |
| ChatGPT Pro | 200 $/mes | GPT-5.5 Pro (sin límite) |
Por API la dispersión es de otro orden. La misma tarea del conjunto de Artificial Analysis cuesta 3,25 $ en Opus 4.8, 2,78 $ en GPT-5.5 Pro, 1,50 $ en Sonnet 4.6, 0,46 $ en GLM-5.2 y 0,048 $ en DeepSeek V4 Pro. Entre el más caro y el más barato hay un factor de 67.
Qué elegir según para qué
- Programar a diario: Claude Sonnet 4.6, con Claude Code encima.
- Razonamiento, matemáticas, ciencia: GPT-5.5 Pro.
- Producción vigilando el coste: GLM-5.2 si necesitas calidad cerca de la frontera; DeepSeek V4 Pro si lo que necesitas es el mínimo por tarea.
- Flujos agénticos de varios pasos: Opus 4.8 vía Claude Code por fiabilidad; NeMoTron 3 Ultra de NVIDIA (550B) como mejor alternativa abierta.
- Contexto largo y bases de código grandes: GLM-5.2, por su millón de tokens y su licencia.
- Código abierto o autoalojado: GLM-5.2, sin discusión.
La estrategia de las dos suscripciones
Para la mayoría, la configuración sensata en junio de 2026 cuesta 40 dólares al mes: Claude Pro más ChatGPT Plus.
Sonnet 4.6 se ocupa de programar, de los flujos agénticos, de revisar código y del contexto largo. GPT-5.5 está para los problemas de razonamiento, las matemáticas, la investigación y el pulido de la escritura. Entre los dos cubren casi todo.
Con menos presupuesto, cambia ChatGPT Plus por GLM-5.2: gratis si te lo alojas, ~0,46 $ por tarea por API. Pierdes algo de profundidad en razonamiento y ganas un modelo MIT que puedes desplegar donde quieras.
Si chocas contra los límites de Sonnet a diario, la escalada es Claude Max (100–200 $/mes) y ChatGPT Pro (200 $/mes). Es el equipo de quien investiga a tiempo completo: caro y sin techo.
En resumen
La suspensión de Fable 5 reordenó el mapa, pero la respuesta práctica cabe en cuatro nombres. Sonnet 4.6 para el día a día. GPT-5.5 para lo que hay que pensar. GLM-5.2 porque hace casi lo mismo por una fracción y con licencia MIT. DeepSeek V4 Pro para cuando cada céntimo cuenta.
El resto, a día de hoy, es redundante, es de nicho o todavía no ha salido.