Ayer salió Claude Opus 5 y mi timeline se llenó de lo de siempre: capturas de benchmarks, gente diciendo que es brutal y gente diciendo que es humo. Lo que casi nadie cuenta es lo único que de verdad te importa si programas con IA a diario: ¿migro mi flujo o no?
Me he leído la documentación oficial, la guía de migración y los datos independientes de Artificial Analysis, y te lo resumo con datos verificables. Spoiler: la respuesta no es “sí” para todo el mundo.
Qué es Opus 5, en datos
Según la tabla oficial de modelos, Opus 5 (claude-opus-5) es esto:
- Precio: 5$ por millón de tokens de entrada y 25$ por millón de salida. Exactamente el mismo precio que Opus 4.8. Esto es lo más importante del lanzamiento y lo que más se está pasando por alto: es más modelo por el mismo dinero.
- Contexto de 1M de tokens por defecto (sin beta header) y hasta 128k tokens de salida.
- Knowledge cutoff de mayo de 2026, el más reciente de la familia.
- Adaptive thinking: el modelo decide cuánto pensar en cada petición. Ya no existe el extended thinking manual con
budget_tokens. - Está disponible en la API de Anthropic, Bedrock, Google Cloud y Microsoft Foundry. Y es el modelo por defecto de Claude Max y el más potente disponible en Claude Pro.
También hay un Fast mode que lo ejecuta a unas 2,5 veces la velocidad normal, al doble de precio, igual que ya existía con Opus 4.8.
Benchmarks: qué ganas
Aquí los datos del anuncio oficial y de terceros, cada uno con su fuente:
- En Frontier-Bench v0.1, Opus 5 supera a todos los modelos del mercado y más que duplica el resultado de Opus 4.8 con menor coste por tarea.
- En CursorBench 3.2, a máximo effort queda a un 0,5% del pico de Fable 5 (el modelo tope de gama de Anthropic), a la mitad de coste por tarea.
- En ARC-AGI 3 triplica al segundo mejor modelo, y en OSWorld 2.0 (computer use) supera el mejor resultado de Fable 5 a poco más de un tercio del coste.
- En el Intelligence Index de Artificial Analysis (datos a 25 de julio de 2026), Opus 5 a máximo effort puntúa 61, el número 1 de 190 modelos. Por comparar: la mediana de su categoría es 32.
Los benchmarks de Anthropic hay que cogerlos con pinzas, como siempre. Pero cuando un tercero independiente lo coloca primero de 190 modelos al día siguiente de salir, la señal es bastante clara: en código agéntico es el nuevo techo a este precio.
El coste real no es el precio por token
Y aquí viene la parte que no te cuenta el titular. El precio por token es el mismo que Opus 4.8, sí. Pero tu factura no depende solo del precio por token: depende de cuántos tokens gasta el modelo, y ahí Opus 5 gasta más:
- El thinking va activado por defecto. En Opus 4.8, una petición sin campo
thinkingse ejecutaba sin pensar. En Opus 5, esa misma petición piensa. Es un breaking change documentado en la guía de migración:max_tokenses un límite duro sobre thinking + respuesta, así que si teníasmax_tokensajustado para workloads sin thinking, te lo va a comer el razonamiento. - Es más verboso. En las mediciones de Artificial Analysis, Opus 5 generó 100M de tokens de salida para completar su Intelligence Index, frente a una mediana de 63M en modelos comparables. La propia guía de migración de Anthropic avisa de que las respuestas visibles salen más largas y de que bajar el effort reduce el thinking pero no acorta la respuesta: hay que pedir concisión explícitamente en el prompt.
- El tiempo también es coste. A máximo effort, Artificial Analysis mide 52,8 tokens/segundo de salida y un tiempo hasta el primer token de más de un minuto. Si tu flujo depende de iteraciones rápidas, eso duele.
La conclusión práctica: a igualdad de tarea bien acotada, Opus 5 puede salirte más barato que 4.8 porque resuelve antes y con menos vueltas. A igualdad de prompt vago, te puede salir más caro porque piensa y escribe más. El effort y el prompt mandan. Si el gasto te preocupa, ya conté por qué Claude Code se bebe tus límites y cómo controlo el mío con PocketMeter.
Setup: qué tocar en Claude Code
Primero, lo obvio pero necesario: Opus 5 requiere Claude Code v2.1.219 o superior. Actualiza:
claude update
A partir de ahí, según la documentación de configuración de modelos:
# Cambiar en la sesión actual
/model opus # el alias "opus" ya resuelve a Opus 5 en la API de Anthropic
# O al arrancar
claude --model opus
Si quieres fijar la versión exacta y que un cambio futuro del alias no te mueva de modelo sin avisar, pinea el ID completo en tu settings o por variable de entorno:
{
"model": "claude-opus-5"
}
Ojo con un detalle: si estás en Bedrock, Google Cloud o Foundry, el alias opus resuelve a Opus 5 en Bedrock y Google Cloud, pero en Microsoft Foundry sigue resolviendo a Opus 4.6. Ahí tendrás que indicar el deployment completo o usar ANTHROPIC_DEFAULT_OPUS_MODEL.
Sobre el effort: el default es high y los niveles van de low a max. Se cambia con /effort en sesión o --effort al arrancar. Mi recomendación tras leer la guía: deja high para el día a día y sube a xhigh o max solo para tareas donde la capacidad importe más que la factura. Si usas xhigh o max, sube max_tokens a 64k como punto de partida, porque el modelo necesita sitio para pensar.
Y si pagas por uso en Claude Code, el Fast mode se activa con /fast y cuesta el doble, con créditos de uso. Útil cuando sabes lo que quieres y solo necesitas que escriba rápido.
Setup: qué tocar en la API
Si tu código está en Opus 4.8, el cambio del ID es trivial, pero hay dos breaking changes que te van a petar si no los miras:
# Esto funcionaba en Opus 4.8 y devuelve un 400 en Opus 5:
client.messages.create(
model="claude-opus-5",
max_tokens=16000,
thinking={"type": "disabled"},
output_config={"effort": "xhigh"}, # thinking desactivado + xhigh/max = 400
messages=[{"role": "user", "content": "..."}],
)
Desactivar el thinking solo se permite con effort high o inferior. Y la otra rotura: las peticiones sin campo thinking ahora piensan, así que revisa tus max_tokens.
Dos cosas más que se rompen o desaparecen: la herramienta de web fetch no está disponible en Opus 5 y Priority Tier no está soportado. Si tu organización tiene un compromiso de Priority Tier, ese tráfico se queda en Opus 4.8, que sí lo mantiene.
Y una que mejora: el mínimo cacheable de prompt caching baja de 1.024 a 512 tokens, así que prompts que antes no se podían cachear ahora sí, sin tocar código.
Si no quieres hacer la migración a mano, Anthropic incluye una skill en Claude Code que la automatiza:
/claude-api migrate this project to claude-opus-5
Cambia el ID, aplica los breaking changes y te deja una checklist de lo que tienes que revisar tú.
Cuándo NO migrar a Claude Opus 5
Esto es lo que de verdad te ahorra dinero:
- Tu workload usa la herramienta de web fetch. No existe en Opus 5. Quédate en 4.8 o rediseña esa parte.
- Tienes Priority Tier contratado. Opus 5 no lo soporta.
- Iteras rápido en tareas sencillas. Para renombrar cosas, escribir tests simples o hacer cambios mecánicos, Sonnet 5 a 3$/15$ (y con precio de lanzamiento de 2$/10$ hasta el 31 de agosto de 2026) o Haiku 4.5 a 1$/5$ son más rápidos y mucho más baratos. De hecho el alias
opusplanexiste precisamente para esto: Opus para planificar, Sonnet para ejecutar. - Tus prompts están llenos de instrucciones de “verifica tu trabajo”. Opus 5 verifica por su cuenta; la guía de migración dice explícitamente que quites esas instrucciones porque causan sobre-verificación. Si no vas a rehacer los prompts, te va a gastar tokens de más. Y si tu problema es que la IA mete la pata, te renta más un AGENTS.MD bien hecho que repetir instrucciones en cada prompt.
- Trabajas en ciberseguridad ofensiva. Opus 5 lleva clasificadores de seguridad que bloquean pentesting y generación de exploits, y las peticiones marcadas se re-enrutan a Opus 4.8. Te vas a pasar el día cayendo en fallbacks.
Mi veredicto
Si programas con Claude a diario, la migración es casi un no-brainer: mismo precio, mejor modelo, y en Claude Code es un /model opus después de actualizar. Pero migra entendiendo que el thinking por defecto y la verbosidad cambian tu factura aunque el precio por token no cambie. Pinea el modelo exacto, revisa tus max_tokens, baja el effort cuando la tarea sea sencilla y deja Sonnet para el trabajo mecánico.
El modelo es bueno. La factura la gestionas tú.
Preguntas frecuentes
¿Cuánto cuesta Claude Opus 5?
5$ por millón de tokens de entrada y 25$ por millón de salida, exactamente igual que Opus 4.8. El Fast mode cuesta el doble. Lo que cambia tu factura no es el precio, sino cuántos tokens gasta: el thinking va activado por defecto y las respuestas son más largas.
¿Merece la pena migrar de Opus 4.8 a Opus 5?
Para programación agéntica, sí: es el número 1 del Intelligence Index de Artificial Analysis al mismo precio. Las excepciones claras son si usas la herramienta de web fetch, tienes Priority Tier contratado o trabajas en seguridad ofensiva, casos en los que te conviene quedarte en Opus 4.8.
¿Se puede desactivar el thinking en Claude Opus 5?
Sí, pero solo con effort high o inferior: combinar thinking desactivado con effort xhigh o max devuelve un error 400 en la API. Y ten en cuenta que las peticiones sin campo thinking ahora piensan por defecto, así que revisa tus max_tokens al migrar.



¿Qué te ha parecido?
Déjame tu opinión, pregunta o sugerencia. Los comentarios se sincronizan con GitHub Discussions .