Anthropic acaba de lanzar Claude Opus 5 sin subir el precio ni un centavo frente a Opus 4.8, y aun así lo posiciona a medio paso del modelo más caro de su catálogo. Esto es lo que realmente cambió.
Claude Opus 5 se lanzó el 24 de julio de 2026 manteniendo el precio exacto de Opus 4.8: 5 USD por millón de tokens de entrada y 25 USD por millón de salida. Lo que cambia no es la tarifa sino la posición del modelo dentro del catálogo de Anthropic — Opus 5 alcanza un nivel de inteligencia cercano al de Claude Fable 5 (el modelo insignia más caro) a la mitad de su costo, según las cifras publicadas por Anthropic y confirmadas por cobertura independiente de TechCrunch y SiliconANGLE.
Para equipos que ya evaluaban el trade-off entre Sonnet y Opus en producción, esto mueve el punto de equilibrio: Opus 5 se vuelve viable para casos donde antes el costo de Opus descartaba la opción por completo.
La novedad de arquitectura más relevante para desarrolladores es el toggle de effort (bajo/medio/alto) que permite decidir, por cada llamada, cuánto cómputo dedicar al razonamiento antes de responder — el mismo mecanismo de `effort` que ya cubrimos para Opus 4.5, ahora refinado con mejor separación entre los tres niveles.
En `low`, Opus 5 mantiene calidad competitiva para tareas cortas a una fracción del gasto en tokens de razonamiento — la misma lógica de escalonamiento de effort que recomendamos en el artículo sobre reducción de costos de LLMs, ahora con un modelo que hace ese ajuste más granular.
Según las cifras publicadas en el system card de Anthropic (24 de julio de 2026) y reportadas por TechCrunch, Opus 5 más que duplica el score de Opus 4.8 en Frontier-Bench v0.1, superando a todos los demás modelos evaluados. En ARC-AGI 3 —un benchmark diseñado específicamente para resistir memorización— Opus 5 triplica el score del siguiente mejor modelo. En OSWorld 2.0 (control de computadora, tareas de uso real de software), Opus 5 supera el mejor resultado de Fable 5 a poco más de un tercio de su costo.
Estos no son incrementos marginales de benchmark — son señales de que Anthropic priorizó específicamente tareas agenticas de uso de herramientas y control de computadora en este ciclo de entrenamiento, área donde compite directamente con las capacidades de Computer Use que Google acaba de integrar nativamente en Gemini 3.6 Flash.
Opus 5 mantiene la ventana de contexto de 1 millón de tokens y sube el límite de salida a 128K tokens. Su fecha de corte de conocimiento es mayo de 2026 — la más reciente de cualquier modelo Claude publicado hasta ahora, lo cual importa concretamente para tareas donde el modelo necesita estar al tanto de frameworks, APIs o eventos recientes sin depender exclusivamente de contexto inyectado vía RAG.
Anthropic describe a Opus 5 como su modelo más alineado hasta la fecha, con las tasas más bajas de comportamiento engañoso medidas internamente. Un cambio contractual relevante para empresas con requisitos de compliance estrictos: Opus 5 soporta zero data retention por defecto, mientras que Fable 5 todavía exige una ventana de retención de 30 días. Para clientes en sectores regulados (financiero, salud, legal) que evalúan qué modelo de la familia Anthropic usar bajo cláusulas de confidencialidad, esta diferencia de política puede pesar tanto como los benchmarks.
Si tu equipo ya tiene una integración con Opus 4.8 vía API, Bedrock o Vertex AI, la migración a Opus 5 es un cambio de `model_id` sin ajuste de presupuesto — mismo precio, misma estructura de facturación. La recomendación práctica es correr el mismo piloto de dos semanas que sugerimos para Opus 4.5: medir costo por tarea resuelta, tasa de re-trabajo humano y latencia p95 con el effort ajustado por tipo de solicitud, antes de mover tráfico de producción completo.
Carlos Montiel es arquitecto de soluciones IA empresarial. Implementa LLMs, Agentes, RAG y orquestadores en empresas de Guatemala y Latinoamérica. Contáctalo para una consultoría.
Contactar a Carlos Montiel