Migración a Opus 4.8, la primera actualización de Opus sin breaking changes
Opus 4.8 está disponible desde el 28 de mayo de 2026. A diferencia del salto a 4.7 no hay breaking changes en la API, solo cambias el campo del modelo. Qué cambia igualmente en el comportamiento, más dos palancas nuevas: Fast Mode y Dynamic Workflows.
Opus 4.8 pasó a GA el 28 de mayo de 2026, apenas seis semanas después de 4.7. Si todavía tienes en la cabeza la migración a 4.7, con los tres errores 400 duros porque temperature, top_p y budget_tokens salieron volando, entonces la buena noticia aquí es corta: esta vez eso no pasa. Opus 4.8 es un drop-in de verdad. Tu código de 4.7 corre sin cambios, solo cambias claude-opus-4-7 por claude-opus-4-8 en el campo del modelo.
Aun así, no es una migración que apruebes a ciegas. El modelo se comporta distinto, y llegan dos palancas nuevas que tocan tus decisiones de coste y arquitectura. Este playbook es para ti si tienes código de API o Claude Code como daily driver y quieres que 4.8 entre limpio.
Paso 1, la actualización de una línea
Busca en tu codebase el string del modelo y cámbialo.
grep -rn "claude-opus-4-7" src/
# cambia cada acierto a claude-opus-4-8
La variante de 1 millón de contexto se sigue llamando claude-opus-4-8[1m], misma escritura que antes. El modelo está disponible de inmediato en la Claude API, Amazon Bedrock, Google Vertex AI, Microsoft Foundry y GitHub Copilot. Sin beta header, sin nuevo pin de SDK, sin campos de request cambiados. Eso es todo técnicamente.
Paso 2, el precio se mantiene, pero revisa tu propia documentación
El precio estándar está sin cambios respecto a 4.7: 5 dólares por millón de tokens de input, 25 dólares por millón de tokens de output. Sin recargo por el modelo nuevo.
Una piedra concreta de la práctica: yo tenía 15 dólares por 75 dólares mal escrito en mi documentación interna, un número invertido de una nota temprana. Si tienes cifras de precio hardcodeadas en algún sitio (dashboards de coste, wikis internos, ofertas a clientes), revísalas contra la página oficial de precios de Anthropic antes de calcular sobre la base de cifras equivocadas. La fuente real es platform.claude.com/docs/en/about-claude/pricing, no tu memoria.
Paso 3, el comportamiento cambia, incluso sin cambio en la API
Esa es la razón real por la que 4.8 no es una migración trivial. La mejora central es honestidad y alineación. Anthropic indica que 4.8 deja pasar un error de código sin marcarlo aproximadamente cuatro veces menos a menudo que 4.7. El modelo señala incertidumbres sobre su propio trabajo más a menudo y hace afirmaciones sin fundamento menos a menudo.
En la práctica eso significa: si tienes un agente que antes corría con seguridad, bajo 4.8 dirá más a menudo "aquí estoy inseguro" o "esta suposición no la verifiqué". Eso es intencional y normalmente mejor. Pero si tu pipeline se apoya en una forma de output concreta (p. ej. un parser que espera un sí/no claro), el hedging adicional puede sorprender a tu código downstream. Recorre una vez tus caminos de agente más importantes y mira si el comportamiento de respuesta más cauteloso rompe en algún sitio una suposición dura.
Las cifras de benchmark para ello, si las necesitas: el coding agentico sube de 64,3 a 69,2 por ciento, el reasoning multidisciplinar con tools de 54,7 a 57,9, el computer use agentico de 82,8 a 83,4. La mejora de coding es el salto más perceptible en el daily driver.
Paso 4, el effort defaultea a high
Opus 4.8 usa por defecto el nivel de effort high. Anthropic indica que en tareas de coding eso consume aproximadamente la misma cantidad de tokens que 4.7, con mejor rendimiento. Puedes subirlo a extra (en Claude Code se llama xhigh) o max, entonces el modelo piensa más largo y consume más tokens.
Si vienes del mundo de 4.7 donde Claude Code defaulteaba en parte a xhigh, entonces high como nuevo default es más bien un ligero alivio de coste con calidad igual o mejor. Para flujos sensibles al coste es buena noticia. Para tareas de reasoning críticas donde quieres el último porcentaje, pon max a propósito en vez de confiar en el default.
Paso 5, Fast Mode como nueva palanca coste-velocidad
Nuevo con 4.8 es Fast Mode. El modelo corre aproximadamente 2,5 veces más rápido, pero cuesta 10 dólares por 50 dólares por millón de tokens, o sea el doble del estándar. Anthropic describe este Fast Mode como tres veces más barato que el Fast Mode de modelos anteriores.
La compensación es clara: doble precio de tokens por 2,5 veces la velocidad. Eso solo vale la pena donde la latencia cuesta dinero real o UX real, p. ej. un flujo de chat interactivo que un usuario espera en vivo, o un trabajo en bloque con una ventana de tiempo dura. Para agentes cron de fondo, pipelines de research o cualquier cosa que corra de forma asíncrona, quédate en estándar. Si no, pagas el doble por velocidad que nadie necesita.
Paso 6, Dynamic Workflows es research preview, no una feature de producción
Junto con 4.8, Anthropic lanzó Dynamic Workflows como research preview, un sistema para coordinar tareas complejas a través de cientos de subagents paralelos en Claude Code. Eso suena exactamente al patrón CEO-worker que quizás ya construyes a mano.
Importante para la migración: research preview no significa listo para producción. Pruébalo en un proyecto de juguete antes de reconstruir tu arquitectura de subagents existente sobre él. Si ya trabajas hoy con tu propio orquestador que funciona, no es motivo para cambiar de inmediato. Observa la feature hasta que salga de preview.
Checklist de migración, cinco puntos
Uno, cambia el campo del modelo de claude-opus-4-7 a claude-opus-4-8, un único grep-and-replace.
Dos, revisa las cifras de precio hardcodeadas contra la página oficial de precios, no calcules de memoria.
Tres, recorre una vez tus caminos de agente más importantes y mira si el comportamiento de respuesta más cauteloso (más hedging, más flags de incertidumbre) rompe en algún sitio una suposición dura de downstream.
Cuatro, pon el nivel de effort a propósito donde cuenta, en vez de confiar en el nuevo default high.
Cinco, corre igualmente los tests de eval contra 4.8 una vez. Incluso sin breaking changes, un prompt que estaba optimizado para el comportamiento de 4.7 puede reaccionar distinto bajo 4.8, justo por el cambio de honestidad.
¿Deberías migrar
Sí, y rápido. No hay breaking changes, el rendimiento de coding es medible mejor, y la mejora de honestidad reduce justo la clase de errores que más te duele en la operación de agentes, es decir el output confiadamente equivocado. Opus 4.7 se mantiene direccionable como claude-opus-4-7, pero esta vez hay poca razón para quedarse en él.
Qué viene después
Si todavía tienes por delante el salto de 4.6 a 4.7, haz primero la migración a Opus 4.7, esa tiene los breaking changes reales. Si quieres montar limpio tu ritual de actualización de Claude Code, Estrategia de actualización de Claude Code explica qué releases son estables. Y si Fast Mode más el nivel de effort mueven tus facturas, Controles de coste de Claude Code para el daily driver tiene el flujo de trabajo para medirlo.
Source
- Anthropic Opus 4.8: https://www.anthropic.com/claude/opus
- Claude API Pricing: https://platform.claude.com/docs/en/about-claude/pricing
- What's new in Claude Opus 4.8: https://platform.claude.com/docs/en/about-claude/models/whats-new-claude-4-8
- TechCrunch sobre la herramienta Dynamic Workflows: https://techcrunch.com/2026/05/28/anthropic-releases-opus-4-8-with-new-dynamic-workflow-tool