← Level 1
Level 1· Lektion 11 von 13

Panorama de modelos 2026: qué modelo de IA para qué

Un resumen honesto de Claude, GPT y Gemini en 2026. Qué clase de modelo basta para cada tarea, sin hype, con precios concretos.

La mayoría echa mano del modelo más caro para todo. Es como sacar el deportivo del garaje para cada viaje a la panadería. Funciona, pero cuesta diez veces más y no te aporta nada para ir a por el pan.

En 2026 cada gran proveedor tiene al menos tres o cuatro clases de modelo. La cara para los problemas difíciles, una intermedia para el día a día, una barata para el volumen. Cuando entiendes cuál está hecha para qué, ahorras dinero y a menudo obtienes incluso mejores resultados, porque un modelo rápido en una tarea sencilla sobredimensiona menos.

Esta lección ordena las tres grandes familias. Sin benchmarks, sin tablas de 40 columnas. Solo la pregunta: cuándo basta con qué.

Claude: Opus, Sonnet, Haiku

Anthropic escalona por tamaño. Los nombres Opus, Sonnet y Haiku existen desde Claude 3 en marzo de 2024, describen la clase de tamaño, no la generación.

La cima actual es Opus 5 desde el 24 de julio de 2026 (5 dólares por millón de tokens de entrada, 25 dólares de salida), el caballo de batalla de gama alta para problemas donde de verdad necesitas razonamiento profundo, cadenas largas de inferencia, arquitectura de código difícil. Dos cosas son nuevas en él: tiene una ventana de contexto de un millón de tokens por defecto, y piensa por defecto sin que tengas que activarlo. Su predecesor Opus 4.8 sigue disponible y cuesta lo mismo. Por debajo, Sonnet 5 desde el 30 de junio de 2026, la clase intermedia que basta para el 90 por ciento del trabajo real, a precio de lanzamiento de 2 y 10 dólares hasta el 31 de agosto de 2026, después 3 y 15. Y abajo del todo Haiku 4.5 (1 y 5 dólares), rápido y barato para clasificación sencilla, resúmenes, respuestas cortas.

Una nota instructiva, porque muestra lo rápido que cambia esto. Anthropic lanzó Claude Fable 5 el 9 de junio de 2026 (10 dólares entrada, 50 dólares salida), una clase por encima de Opus. Tres días después, el 12 de junio, ya no estaba, en todo el mundo para todos, porque un control de exportación de EE. UU. tras un jailbreak reportado prohibió el acceso a los extranjeros y Anthropic prefirió cortar el acceso a todos antes que comprobar nacionalidades en tiempo real. El 30 de junio la autoridad de EE. UU. levantó de nuevo el control, y desde el 1 de julio Fable está de vuelta a nivel global, también en la UE. Un detalle sigue siendo importante para los usuarios europeos: Fable y su modelo hermano Mythos cuentan como Covered Models con una retención obligatoria de al menos 30 días, no hay opción de retención cero de datos, tampoco en regiones de la UE. Donde eso importa, Opus 4.8 es la opción más tranquila. La lección de verdad no es "coge el modelo más fuerte", sino "construye de forma que la pérdida de un solo modelo no te tumbe". Más sobre esto en un nivel posterior.

Mi consejo práctico: empieza con Sonnet. Si la respuesta se queda claramente corta, sube un escalón. Si ordenas mil correos al día, baja a Haiku. No tienes que adivinar, puedes simplemente probarlo, la diferencia se ve en cuanto lees el resultado.

GPT: Instant, Thinking, Pro y la rama Codex

En 2026 OpenAI separa por esfuerzo de razonamiento en vez de por tamaño. El predeterminado para el chat normal es GPT-5.5 Instant desde mayo de 2026, también en la versión gratuita (ahí con un cupo de uso). Rápido, responde al instante, bueno para conversaciones normales y la mayoría de preguntas del día a día.

Si quieres que "piense más", está el escalón Thinking, GPT-5.5 Thinking en los planes de pago. Desde el 9 de julio de 2026 por encima está la generación GPT-5.6, y esa se reparte en tres papeles en vez de en tamaños: Sol para lo más duro, explícitamente también para programar y para tareas agénticas, es decir, modelos que planifican varios pasos por sí solos y usan herramientas. Terra para el día a día equilibrado. Luna para lo rápido y sensible al coste. En los planes de pago llegas a Sol a través de los ajustes de razonamiento.

Interesante para quien programa: la rama Codex. Si buscas "chatgpt codex" acabas aquí, y si de verdad quieres montarlo, De ChatGPT a Codex te lleva en diez pasos. La generación 5.6 también ha llegado ahí, Terra y Luna están disponibles en Codex. El principio sigue siendo el mismo: si generas código todo el día, la variante más pequeña y rápida suele ser la opción más lista, porque no llegas al límite a las tres horas. El 30 de julio de 2026 OpenAI volvió a mover el precio justo ahí, Luna bajó un 80 por ciento, Terra un 20.

Un apunte al margen, porque mucha gente tropieza con esto: los modelos antiguos se retiran. GPT-4.5 se fue el 27 de junio de 2026, o3 desaparece el 26 de agosto de 2026. Si tu flujo de trabajo sigue clavado a un nombre de modelo antiguo, revísalo a tiempo.

Gemini: Pro, Flash, Flash-Lite

Google escalona de forma parecida a Anthropic, solo que con otros nombres. El patrón es fácil de recordar: Pro para razonamiento y coding pesados, Flash para el día a día rápido, Flash-Lite para alto volumen a precio pequeño.

El modelo más nuevo es Gemini 3.6 Flash desde el 21 de julio de 2026, el caballo de batalla declarado de Google: un millón de tokens de contexto, mejor programando, y hasta un 17 por ciento más ahorrador en consumo de tokens que su predecesor 3.5 Flash, a 1,50 dólares de entrada y 7,50 de salida. El mismo día llegaron 3.5 Flash-Lite para el volumen barato y 3.5 Flash Cyber, este último un modelo especializado en encontrar fallos de seguridad que solo reciben gobiernos y socios seleccionados.

Una particularidad que conviene conocer: en Gemini 3.5 no hay Pro. Google lo anunció y luego lo aplazó, así que el escalón Pro sigue en la generación anterior. Con Google merece la pena comprobar qué escalón existe de verdad en la generación actual, en vez de deducir la disponibilidad a partir del patrón. Junto a la línea Flash está además Gemini Omni, un modelo multimodal que convierte entradas cualesquiera en salidas cualesquiera, es decir, texto, imagen, audio en combinación.

Si ya vives metido en el universo de Google, con Drive, Docs, Gmail, Gemini suele ser la opción evidente, simplemente porque la conexión ya está ahí.

La verdad honesta

Las diferencias entre las tres familias son menores de lo que el marketing te quiere hacer creer. En una tarea media apenas notarás diferencia entre Sonnet, GPT-5.5 y Gemini Flash. La gran palanca no es qué marca, sino qué escalón dentro de una marca.

Donde de verdad se separan es en lo pesado. Arquitectura de código profunda, trabajo autónomo largo a lo largo de muchos pasos, problemas que requieren un pensamiento real de varias etapas. Ahí pagas por los modelos tope, y ahí también merece la pena.

Un segundo punto que suele pasarse por alto: el modelo por sí solo no hace un buen asistente. Lo que marca la diferencia es el contexto. Un Sonnet que conoce tu proyecto le gana a un Opus que adivina a ciegas. Justo aquí entra algo como un codebase-memory-mcp, una herramienta que le da al modelo memoria persistente sobre tu código. Pero esa es una historia para un nivel posterior.

Por ahora basta con esto: no agarres por reflejo el más caro. Empieza en el medio, sube cuando haga falta, baja cuando puedas.

Quiz

1. Quieres clasificar automáticamente mil correos de clientes al día en categorías. ¿Qué clase de modelo encaja mejor?

  • A) Opus 5
  • B) Haiku 4.5 o Gemini Flash-Lite
  • C) GPT-5.6 Sol

La correcta es B. La clasificación sencilla a gran volumen es justo el caso para el escalón barato y rápido. Un modelo tope sería puro derroche de dinero.

2. ¿Qué describen los nombres Opus, Sonnet y Haiku?

  • A) La generación del modelo
  • B) El año de lanzamiento
  • C) La clase de tamaño dentro de una generación

La correcta es C. Los nombres de escalón existen desde Claude 3 y representan grande, mediano, pequeño, no la generación.

3. Generas código de forma agéntica todo el día y no quieres llegar al límite de uso. ¿Qué suele ser la opción más lista?

  • A) GPT-5.6 Sol
  • B) GPT-5.6 Luna
  • C) GPT-4.5

La correcta es B. Luna es el escalón rápido y sensible al coste de la generación 5.6 y está disponible en Codex, así que no llegas al límite a las tres horas. C queda fuera de todos modos, GPT-4.5 se retiró el 27 de junio de 2026.

Source

Los nombres de modelo, versiones y precios concretos de esta lección están contrastados con la documentación oficial de los proveedores (a 31 de julio de 2026):

Sobre las novedades de julio en detalle:

Sobre la nota de Fable 5 (lanzamiento el 9 de junio de 2026, suspensión mundial el 12 de junio tras un control de exportación de EE. UU., levantamiento el 30 de junio, vuelta global incluida la UE el 1 de julio de 2026):

Los nombres de modelo y los precios cambian rápido. Si lees esta lección meses después, revisa las versiones en los enlaces de arriba.

Estás leyendo sin cuenta. Login guarda tu progreso para que retomes donde lo dejaste. Iniciar sesión →