
Precios de Claude Opus 5 de un vistazo
Claude Opus 5 se lanzó el 24 de julio de 2026, descrito por Anthropic como un modelo que "se acerca a la inteligencia de frontera de Claude Fable 5 a la mitad del precio". La tarifa de la API es la misma que la línea Opus ha mantenido desde Opus 4.5.
| Por qué pagas | Tarifa de Claude Opus 5 |
|---|---|
| Tokens de entrada | $5 por millón |
| Tokens de salida (incluyendo thinking) | $25 por millón |
| Escritura de caché de 5 minutos | $6.25 por millón |
| Escritura de caché de 1 hora | $10 por millón |
| Lectura de caché | $0.50 por millón |
| Entrada / salida de Batch API | $2.50 / $12.50 por millón |
| Entrada / salida en modo fast | $10 / $50 por millón |
Inferencia solo en EE.UU. (inference_geo) | 1.1x cada categoría de token |
Todas las cifras anteriores provienen de la documentación de precios de Anthropic. Algunas especificaciones que definen la factura más que la tarifa en sí:
- El ID del modelo es
claude-opus-5en la Claude API,anthropic.claude-opus-5en Bedrock. - El contexto es de 1M tokens de entrada, 128k tokens de salida, que sube a 300k de salida en la Batch API con un header beta.
- La fecha de corte de conocimiento fiable es mayo de 2026.
- Opus 5 tiene su propio grupo de límite de tasa. Opus 4.8, 4.7, 4.6 y 4.5 comparten un pool combinado y Opus 5 no toma de ahí, así que mover tráfico entre ellos no libera margen.
Si estás comparando esto con la generación anterior, nuestra guía de precios de Opus 4.5 y el desglose de Opus 4.6 tienen la misma tarifa, lo que hace inusualmente limpia la comparación versión contra versión.
Por qué se te factura realmente
Esta es la parte que sorprende a quienes migran desde Opus 4.8. En 4.8, una solicitud que omitía el campo thinking se ejecutaba sin thinking. En Opus 5, la misma solicitud ejecuta adaptive thinking, y cada token de thinking se factura como salida a $25 por millón.

Hay dos efectos secundarios que vale la pena presupuestar:
max_tokensahora cubre el thinking y la respuesta juntos. Un límite que ajustaste de forma ceñida solo para la respuesta visible en 4.8 puede truncar la respuesta a mitad de camino en Opus 5. La guía de migración de Anthropic sugiere al menos 64k como punto de partida en effort xhigh o max.- Opus 5 escribe más largo por defecto. La guía de migración es tajante: tanto las respuestas visibles como los entregables escritos son más largos que en 4.8, y bajar el effort reduce el volumen de thinking sin acortar de forma fiable la respuesta visible. La longitud hay que pedirla en el prompt, no ajustarla con un dial.
Hay una tercera línea de factura que la gente olvida en los bucles agénticos: cada resultado de herramienta que devuelves reingresa como input en el siguiente turno. Una ejecución agéntica de 30 pasos paga una y otra vez por la misma transcripción creciente, que es exactamente por qué el cacheo importa más aquí que en el chat. Si tu bucle extrae contexto a través de herramientas MCP o Claude Skills, cada uno de esos resultados cae del lado del input de la misma factura.
Un modelo, cuatro precios
Los mismos pesos y el mismo ID de modelo pueden facturarse a cuatro tarifas distintas dependiendo únicamente de cómo los llames.

El cacheo de prompts es la palanca más grande para cualquier cosa con un prefijo estable. Las escrituras cuestan 1.25x el input base en la caché de 5 minutos y 2x en la de 1 hora, y las lecturas cuestan 0.1x. La mejora silenciosa en Opus 5 está en el piso: el prefijo mínimo cacheable baja a 512 tokens, desde 1,024 en 4.8 y 4,096 en Opus 4.6. Los system prompts que antes eran silenciosamente no cacheables ahora se cachean sin ningún cambio de código.
Batch quita el 50% en ambas direcciones, y se combina con el cacheo. Si tu carga de trabajo tolera una cola, esto es dinero gratis.
El modo fast va en la otra dirección. Según la documentación del modo fast, entrega hasta 2.5x más tokens de salida por segundo por exactamente el doble de precio, y vale la pena nombrar el trato con precisión: a $10 y $50, Opus 5 en modo fast cuesta lo mismo por token que el Claude Fable 5 estándar. También es una vista previa de investigación solo en la API de primera parte, y no funciona con Batch.
La inferencia solo en EE.UU. añade un 1.1x plano en cada categoría de token, lo que da $5.50 y $27.50.
El effort es el verdadero dial de precio
Esta es la sección que leería dos veces si estuviera dimensionando un presupuesto. Opus 5 admite cinco niveles de effort, y la orientación cambió respecto a la era 4.x: donde 4.7 y 4.8 te decían empezar en xhigh para trabajo agéntico, Opus 5 dice empezar en el high por defecto y bajar desde ahí.

Las cifras detrás de esa recomendación vienen de la propia ejecución de Frontier-Bench v0.1 de Anthropic, un benchmark de terminal de 74 tareas que sucedió a Terminal-Bench 2.1:
| Effort | Puntaje Frontier-Bench | Nota de tokens |
|---|---|---|
| low | 25% | 64% menos tokens de salida |
| high | 39% | 19% menos tokens de salida |
| xhigh | 44.4% | mejor resultado |
| max | ~43% | más gasto, ligeramente peor |
Dos cosas llaman la atención. El effort max puntuó peor que xhigh mientras costaba más, y el effort low entregó bastante más de la mitad del puntaje por aproximadamente un tercio de los tokens de salida. Anthropic explica la caída del effort max en FrontierCode 1.1 como el modelo haciendo "más cambios de los que la tarea requiere", algo que el evaluador penaliza.

Lee ese gráfico como un gráfico de precios, no como una tabla de clasificación. Todo el argumento de costo de Opus 5 es que su curva se sitúa por encima y a la izquierda de la de Fable 5: alcanza un puntaje más alto a un costo por intento más bajo. Eso es una afirmación más útil que cualquier número de benchmark individual, y es la misma forma que Anthropic reporta en CursorBench, donde Opus 5 llega "dentro del 0.5% del puntaje máximo de Fable 5, pero a la mitad del costo por tarea".
Calcula tu propia factura mensual
Las tarifas de etiqueta solo se vuelven reales cuando les aplicas tu propio volumen. Introduce un mes de uso y mira qué hacen las palancas.
Una advertencia que la calculadora no puede modelar: los recuentos de tokens no son comparables entre generaciones. Anthropic señala que Claude 4.7 en adelante tokeniza el mismo texto en aproximadamente un 30% más de tokens que Sonnet 4.6 y anteriores, así que una comparación plana por millón contra un modelo más antiguo subestima la factura real.
Cómo se compara Opus 5 con el resto de la línea
| Modelo | Entrada / MTok | Salida / MTok | Contexto | Dónde encaja |
|---|---|---|---|---|
| Claude Fable 5 | $10 | $50 | 1M | El techo de capacidad |
| Claude Opus 5 | $5 | $25 | 1M | Codificación agéntica, trabajo empresarial |
| Claude Opus 4.8 | $5 | $25 | 1M | Priority Tier, web fetch |
| Claude Sonnet 5 | $2 (luego $3) | $10 (luego $15) | 1M | Trabajo de volumen |
| Claude Sonnet 4.6 | $3 | $15 | 1M | Caballo de batalla anterior |
| Claude Haiku 4.5 | $1 | $5 | 200K | Clasificación, enrutamiento |
La propia orientación de Anthropic es empezar con Opus 5 y subir a Fable 5 solo cuando necesites el techo.
Frente al resto del mercado, nuestras comparaciones de precios de Gemini y precios de GPT-5.6 sitúan a Opus 5 en el rango caro-pero-eficiente. Los enfrentamientos directos en Gemini 3 Pro y Codex vs Opus 4.6 todavía describen la forma de ese intercambio, y la comparación de tres APIs es la forma más rápida de verificar un cambio.
Hay dos cosas que Opus 4.8 conserva y Opus 5 pierde, e importan para la planificación: según las notas de migración, web fetch no está disponible en Opus 5 y Priority Tier no es compatible. Si tienes un compromiso de Priority Tier, esa capacidad no se traslada.
Lo que cuestan las cargas de trabajo reales
Las tarifas son abstractas. Esto no lo es.
Una sesión de codificación. El propio ejemplo trabajado de Anthropic sitúa una sesión de Opus 5 de una hora en 50,000 tokens de entrada y 15,000 de salida: $0.25 más $0.375 más $0.08 de tiempo de ejecución de Managed Agents, o $0.705. Activa el cacheo para 40,000 de esos tokens de entrada y la misma sesión llega a $0.525, un recorte del 25% sin ningún cambio de comportamiento.
Un flujo de trabajo empresarial. En el AutomationBench de Zapier, Opus 5 obtuvo un 24% con effort medium por $0.89 por tarea, lo que Anthropic señala que "supera significativamente tanto a Claude Opus 4.8 como a Fable 5 a menos de la mitad del costo".

Una suite de evaluación completa. En el otro extremo, Artificial Analysis publica lo que gastó ejecutando su propio índice:
"In total, it cost $3835.51 to evaluate Claude Opus 5 (Adaptive Reasoning, Max Effort) on the Intelligence Index."
Esa cifra es el contrapeso honesto de todos los gráficos de costo por tarea anteriores. Opus 5 encabeza ese mismo índice con 61 puntos, en el puesto 1 de 190 modelos, pero quemó 100M de tokens de salida para llegar ahí, frente a una mediana de 63M. La eficiencia por tarea completada y el gasto total son preguntas distintas, y Opus 5 las responde de forma distinta.

Varios clientes de acceso anticipado pusieron cifras al mismo efecto. Un equipo de agentes legales reportó 26% menos tokens con un rendimiento similar frente a Opus 4.8 en max reasoning, y un benchmark de trading aterrizó en "aproximadamente una séptima parte de los tokens de reasoning y menos de la mitad de la latencia". Esas cifras son proporcionadas por el proveedor y sin nombre, así que hay que ponderarlas en consecuencia, pero la dirección es consistente en seis relatos independientes.
Claude Pro, Max, Team y Enterprise
No todos recurren a la API. Según la publicación de lanzamiento, Opus 5 es el nuevo modelo por defecto en Claude Max y el modelo más potente en Claude Pro.
| Plan | Mensual | Anual | Acceso a Opus 5 |
|---|---|---|---|
| Free | $0 | $0 | No, solo Sonnet y Haiku |
| Pro | $20 | $17/mes, $200 por adelantado | Sí, más Fable vía créditos |
| Max 5x | $100 | Solo mensual | Sí, modelo por defecto |
| Max 20x | $200 | Solo mensual | Sí, modelo por defecto |
| Team (standard) | $25/asiento | $20/asiento | Sí |
| Team (premium) | $125/asiento | $100/asiento | Sí, 5x el uso estándar |
| Enterprise | - | $20/asiento más uso | Sí, contexto de 500k |
Los precios son de la página de precios de Claude. Dos detalles que confunden a los compradores:
- Los límites se basan en sesiones, no en mensajes. Se reinician en una ventana móvil de cinco horas con topes semanales encima, y web, escritorio, móvil y Claude Code sacan todos del mismo pool. No hay un recuento de mensajes contra el cual planificar.
- Los planes de pago se desbordan hacia las tarifas de la API. Al alcanzar un límite puedes activar créditos de uso para seguir trabajando a tarifas estándar, que es donde los $5 y $25 mencionados arriba empiezan a aplicarse a un asiento de suscripción.
Ese modelo de sesión está produciendo experiencias muy distintas con el mismo lanzamiento, y la diferencia sigue casi perfectamente el nivel de plan. Un usuario de Max 20x:
"I have now been using Opus 5 only (since I'm out of Fable) for about 7 hours and it drained about 6% of my weekly usage."
Y un usuario de Pro en la misma semana:
"I'm only on the Pro plan but a single prompt with Opus 5 w/ high thinking used 100% of my 5-hour usage limit."
Ambos pueden ser ciertos, porque un límite de sesión es un pool de tokens y Opus 5 gasta de él más rápido con effort alto. En un asiento Pro de $20, ese pool es lo bastante pequeño como para que un solo prompt intensivo en thinking lo agote. La solución práctica a la que ha llegado la gente no es actualizar de plan: es bajar el effort para el trabajo rutinario y reservar high para las tareas que lo necesitan.
Para los equipos que sopesan la vía de suscripción contra el gasto directo de la API, nuestra guía de precios de Claude Code y el recorrido por Claude Code empresarial cubren las cuentas de asientos. La configuración de modelo en Claude Code es donde fijas Opus 5 en lugar de dejar que lo elija automáticamente, y la guía de selección de modelo cubre cuándo dejarlo bajar a un nivel más barato. Si todavía estás decidiendo si todo el ecosistema encaja contigo, nuestra reseña de Claude y la guía de precios de Claude Cowork dan la visión más amplia.
Bedrock, Vertex, Foundry y la peculiaridad del CCU
Opus 5 está disponible en todas las plataformas desde el día uno, pero la facturación no es idéntica.
- Amazon Bedrock y Google Cloud están operados por socios. El proveedor de la nube te factura, y Anthropic señala los precios de Bedrock y los precios de Vertex AI como la fuente de verdad en lugar de publicar sus propias tarifas.
- Los endpoints regionales llevan un recargo del 10% sobre los globales en ambas nubes.
- Claude Platform en AWS y Microsoft Foundry facturan en Claude Consumption Units. Se valoran en USD a las tarifas estándar por modelo y luego se convierten a $0.01 por CCU con medición por hora. Tu factura muestra una sola línea de CCU, no un desglose de tokens.
- El modo fast es solo de primera parte. No existe en Bedrock, Google Cloud ni Foundry.
Si tu equipo de finanzas está conciliando una factura de AWS contra un modelo por token, la conversión de CCU es donde ambos dejan de cuadrar.
Lo que dicen los desarrolladores
La reacción de la semana de lanzamiento se dividió casi de inmediato en dos bandos, y la división es enteramente sobre tokens, no sobre tarifas. El primer bando hizo los cálculos y encontró que el precio plano ocultaba un aumento real.
"At the same levels of thinking it's appears that Opus 5 in it's current form uses about 2x the amount of output tokens to do similar tasks. So per token is the same, but the models don't use the same amount of tokens to do the same task."
Un desarrollador gastó dinero real para resolverlo. Ejecutando la misma tarea en distintos niveles de effort, registró Opus 5 en $0.41514 en low y $0.801965 en medium, frente a $0.210415 para Opus 4.8 en low:
"At matched effort, Opus 5 spends roughly 2x the output tokens of 4.8."
Las tablas de clasificación de terceros recogieron la misma señal desde otro ángulo:
"Vals Index Opus 4.8 > 5.0 goes from $2.90 to $8.54, for 4% gain ... That is a massive cost increase. Sure, 20% cheaper then Fable, but that is a 3x price increase compared to Opus 4.8 in that test."
El mecanismo que la gente sigue describiendo es el scope creep, el mismo comportamiento sobre el que advierte la propia documentación de Anthropic cuando te dice que elimines las instrucciones de verificación heredadas porque Opus 5 verifica su propio trabajo sin que se lo pidan:
"it just reviews every minor change with unnecessary checks that would take a couple minutes to check manually, it wants to spend an hour and spend $25 of tokens"
El contraargumento es justo y vale la pena tenerlo presente. El total de tokens quemados es el denominador equivocado si el modelo termina un trabajo que el más barato abandona:
"When we look at some benchmarks that publish the cost per successful task, Claude seems to be way cheaper than I expected. For example on https://livebench.ai/
here the cost per successful task for Opus 5 is lower than Sol."
Y hay bastante gente que simplemente está contenta con el cambio:
"I switched from 4.8 to 5 yesterday and I'd have to say that I've noticed an improvement, though not hugely perceptible, the model seems to want to do more work per turn, possibly a tiny bit faster, and little less verbose when it isnt necessary to be so."
Mi lectura: ambos bandos tienen razón, y el desacuerdo en realidad es sobre contra qué denominador estás facturando. Si mides tokens, Opus 5 se encareció. Si mides tareas terminadas, se abarató. Cuál de los dos describe tu negocio es la pregunta real que esta página de precios no puede responder por ti.
¿Vale la pena Claude Opus 5 a $5 y $25?
Para trabajo agéntico de largo horizonte, sí, y el argumento no es realmente sobre la tarifa. Opus 5 cobra lo mismo que cobraba Opus 4.8 mientras obtiene 96.0% en SWE-bench Verified y más que duplica a 4.8 en Frontier-Bench. Cuando una ejecución cuesta $0.89 y termina en lugar de costar $0.40 y fallar dos veces, el modelo más barato por token nunca fue realmente más barato.
Tres advertencias honestas antes de estandarizarlo:
- Es verboso, y la verbosidad se factura a $25. Artificial Analysis lo llama "particularmente caro al compararlo con otros modelos de precio similar" y "notablemente lento y muy verboso". Presupuesta tiempo de ingeniería de prompts para controlar la longitud, porque el effort por sí solo no lo hará.
- La alucinación fue ligeramente en la dirección equivocada. La system card declara sin rodeos que el modelo "alucina afirmaciones fácticas ligeramente más que Opus 4.8, a pesar de ser más preciso en general".
- Los modelos más baratos siguen ganando mucho trabajo. Para clasificación, enrutamiento y redacción masiva, Claude Sonnet 5 al 40% del precio es la mejor compra, y Haiku es todavía mejor. Si estás comparando opciones, nuestro resumen de alternativas a Opus 4.6 y las anteriores alternativas a Opus 4.5 cubren el terreno, con precios de Mistral y precios de Groq en el extremo más barato.
Dónde encaja el modelo en una cadena de herramientas real es una pregunta aparte de la tabla de tarifas. Nuestros resúmenes de asistentes de codificación con IA, herramientas de desarrollo de Claude y Cursor son donde eso se decide en la práctica.
Para que conste, mi propio ajuste por defecto en herramientas internas es effort high con cacheo de 1 hora en el system prompt y Batch para todo lo que pueda esperar. Esa combinación deja la mayoría de los trabajos entre un cuarto y la mitad de la factura ingenua a tarifa estándar.
Dónde la factura de tokens deja de ser tu problema
Todo lo anterior asume que quieres ser dueño de la fontanería: la lógica de reintentos, el ajuste de effort, la invalidación de caché, el fallback cuando un clasificador de seguridad rechaza una solicitud. Eso es un proyecto de ingeniería real, y he visto a varios clientes técnicos dejar eesel para construir exactamente eso directamente sobre la API de Claude.
Algunos de ellos están perfectamente contentos. Otros terminan donde terminó este cliente:
"We could try to write our own LLM application but we didn't want to invest our time into that. We wanted something that we would not have to maintain."
Karel, GENERAL BYTES
Esa es la decisión real detrás de una página de precios de Claude Opus 5. Si quieres un modelo de frontera respondiendo tickets de soporte, la tarifa por token es quizás una quinta parte del trabajo. El resto es fundamentarlo en tu centro de ayuda y tickets pasados, mantenerlo en silencio en las preguntas que no debe tocar, y saber qué va a hacer antes de que toque una cola en vivo.

eesel es esa capa, vendida como un precio por tarea con el gasto del modelo ya incluido, así que un mes ocupado se traduce en más tickets resueltos en lugar de una factura de tokens que tienes que explicar. Puedes simularlo contra tus propios tickets históricos antes de que le responda a nadie, y conectarlo en unos minutos. Prueba eesel gratis.
Si el contenido en lugar del soporte es tu caso de uso, la misma lógica impulsa nuestro redactor de blog con IA, y las guías sobre el mejor LLM para blogging y cómo hacer que el contenido de IA suene humano son el punto de partida.
Preguntas frecuentes
¿Cuánto cuesta Claude Opus 5 por millón de tokens?
¿Es Claude Opus 5 más caro que Claude Opus 4.8?
¿Cuál es la forma más barata de ejecutar Claude Opus 5?
¿Cambia el precio de Claude Opus 5 con la ventana de contexto de 1M?
¿Cuánto cuesta Claude Opus 5 en los planes Pro y Max?
¿Qué ofrece mejor relación calidad-precio, Claude Opus 5 o Claude Sonnet 5?
¿Qué añade el modo fast al precio de Claude Opus 5?

Article by
Rama Adi Nugraha
Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.







