Ya está aquí Claude Opus 5: qué cambia de verdad en tus planes
Anthropic publicó Claude Opus 5 el 24 de julio de 2026. Es el cuarto modelo que saca la empresa en menos de dos meses, después de Mythos 5, Fable 5 y Sonnet 5 en junio. Para la mayoría de equipos ese ritmo importa más que cualquier benchmark suelto: la capacidad de los modelos ya avanza más rápido de lo que la mayoría de hojas de ruta es capaz de absorber.
El resumen del lanzamiento: Opus 5 sale al mismo precio que Opus 4.8, cinco dólares por millón de tokens de entrada y veinticinco por millón de salida. En varios de los benchmarks del propio anuncio de Anthropic supera a Fable 5, que cuesta el doble. Anthropic lo plantea como el modelo por defecto para casi todo el mundo.
Claude Opus 5 en 24 segundos: qué cambia, cuánto cuesta y dónde está ahora el cuello de botella
Los tres cambios que importan en lo comercial
1. El precio no se movió, el techo sí. Un salto de capacidad que llega sin subida de precio es de los pocos que puedes aprovechar el mismo día. Cualquier carga de trabajo ya presupuestada con las cifras de Opus 4.8 mantiene el mismo coste unitario y da mejor resultado. No hay que reabrir ninguna conversación con compras.
2. El esfuerzo pasa a ser un mando que controlas tú. Opus 5 expone un ajuste de esfuerzo que va de bajo a máximo dentro del mismo modelo. Ya no eliges un modelo barato o uno caro al diseñar y cargas con esa decisión para siempre. Eliges, petición a petición, cuánto cómputo merece la tarea. Una clasificación va en bajo, un plan de migración va en alto, y las dos corren con el mismo identificador de modelo.
Este es el cambio que más equipos van a desaprovechar. El instinto es elegir un nivel de esfuerzo, meterlo en un fichero de configuración y olvidarse. El dinero está en el enrutado: esfuerzo barato para el noventa por ciento de llamadas que son búsquedas y formateo, esfuerzo caro para el diez por ciento que sostiene la decisión.
3. Un millón de tokens de contexto, por defecto. Opus 5 tiene una ventana de contexto de un millón de tokens. En la práctica eso significa un repositorio entero, o una sala de datos completa, o un año de tickets de soporte, dentro de una sola petición. El patrón que dominó 2024 y 2025, trocear documentos y recuperar fragmentos, pasa a ser opcional para muchos problemas en lugar de obligatorio.
Lo que no ha cambiado
El modelo casi nunca era el motivo por el que fallaba un proyecto. Sigue sin serlo.
Por lo que vemos entregando proyectos, lo que hunde la IA en producción es poco lucido y este lanzamiento no lo toca: nadie acordó qué significa "correcto", no hay conjunto de evaluación, los datos viven en un sistema sin API, el proceso que se quiere automatizar nunca se puso por escrito y nadie se hace responsable del resultado una vez generado. Nada de eso mejora porque el modelo sea mejor. Alguna cosa empeora, porque un modelo más capaz produce salidas creíbles más deprisa, y eso incluye las salidas malas.
Si la semana pasada tenías un piloto de IA parado, Opus 5 no lo reactiva. Lo reactiva volver a acotarlo.
Notas prácticas si vas a construir sobre él hoy
Cuatro detalles fáciles de pasar por alto y caros de descubrir en producción:
El razonamiento viene activado. En Opus 5, omitir el parámetro de razonamiento significa que el modelo razona. En Opus 4.8 significaba lo contrario. Como `max_tokens` limita el razonamiento y el texto de respuesta juntos, una petición ajustada al milímetro con el modelo anterior puede quedarse cortada a media frase.
Desactivarlo tiene un tope. Solo se permite con esfuerzo `high` o inferior. Combinar razonamiento desactivado con `xhigh` o `max` devuelve un 400.
Los límites de uso van aparte. Opus 5 no consume del cupo compartido de Opus 4.x. Mover tráfico ni libera margen en el cupo antiguo ni lo hereda. Revisa tu nivel antes de desplazar volumen.
La caché entra antes. El mínimo cacheable baja a 512 tokens, frente a los 1024 de Opus 4.8. Prompts que dabas por demasiado cortos para cachear puede que ahora caché sin tocar una línea.
Contempla el rechazo. Opus 5 llega con salvaguardas de ciberseguridad reforzadas, y una petición rechazada devuelve un HTTP 200 correcto con `stop_reason: "refusal"`. El código que lee el primer bloque de contenido sin comprobar nada se rompe ahí.
La recomendación honesta
Si tienes un sistema en producción sobre Opus 4.8, migrar es cambiar el identificador de modelo y comprobar dos cambios que rompen, con una economía estrictamente mejor. Hazlo, pero detrás de tu conjunto de evaluación.
Si no tienes conjunto de evaluación, ese es el proyecto. No la migración.
Y si estabas esperando a que los modelos se asienten antes de comprometerte con un desarrollo, este lanzamiento es el argumento contra esperar. Cuatro modelos punteros en menos de dos meses no indica que el suelo vaya a dejar de moverse. Indica que quien está sacando valor es quien montó la capa fina que le permite cambiar el modelo de debajo sin reescribir el producto.
Esa capa es una semana de trabajo. También es la diferencia entre que un lanzamiento así te cueste una tarde o te cueste un trimestre.
---
Fuentes: TechCrunch, "Anthropic launches Opus 5" · Fortune · Documentación de modelos de Anthropic
¿Construyes sobre modelos punteros y quieres esa capa de intercambio bien hecha a la primera? Reserva una llamada de alcance.