
Resumen rápido
El precio de Claude Fable 5.1 en la API es de $10 por millón de tokens de entrada y $50 por millón de tokens de salida, sin cambios respecto a Fable 5. Lo único que realmente se movió son las lecturas de caché, que bajaron un 75%, de $1 a $0,25 por millón de tokens. Anthropic estima que ese único cambio reduce el coste de una carga de trabajo típica en un 25% aproximadamente, y el de una muy agéntica hasta en un 45%, ya que las ejecuciones largas de agentes releen el mismo prefijo en caché una y otra vez.
El procesamiento por lotes cuesta la mitad ($5 de entrada / $25 de salida). La inferencia solo en EE. UU. tiene un recargo de 1,1x. Fable 5.1 es el Claude actual más caro en tarifas base (2x Opus 5, 5x Sonnet 5), pero su lectura de caché a $0,25 es en realidad la más barata de los tres. Está disponible en Pro, Max, Team, Enterprise y en la API, pero no en el nivel gratuito.
Si estás calculando el coste de Fable 5.1 específicamente para atención al cliente, recuerda que el modelo es infraestructura, no el producto. Le pagas a Anthropic por token; aun así tienes que construir la recuperación de información, las barreras de seguridad y la lógica de escalado por encima. Un compañero como eesel funciona con modelos como este y en cambio te cobra por ticket resuelto, así que la cifra se mantiene predecible sin importar cuánto "hable" el modelo subyacente.
Los precios de Claude Fable 5.1 de un vistazo
Aquí está toda la tarifa, directamente de la documentación de precios de Claude Platform. Cada cifra es por millón de tokens (MTok), en USD.
| Medidor | Claude Fable 5.1 | Claude Fable 5 (anterior) |
|---|---|---|
| Entrada base | $10 / MTok | $10 / MTok |
| Salida | $50 / MTok | $50 / MTok |
| Lecturas de caché (hits y actualizaciones) | $0,25 / MTok | $1 / MTok |
| Escrituras de caché de 5 minutos | $12,50 / MTok | $12,50 / MTok |
| Escrituras de caché de 1 hora | $20 / MTok | $20 / MTok |
El patrón que hay que notar: cuatro de las cinco cifras son idénticas a Fable 5. No es un nuevo nivel de precios, es la misma tarifa del modelo con una línea reescrita. Así que si presupuestabas con Fable 5, tus cálculos de entrada y salida no cambian en absoluto.
Otra cosa que vale la pena fijar antes de hacer cualquier cálculo: Fable 5.1 usa el mismo tokenizador que Fable 5 (el que se introdujo con Opus 4.7). Frente a modelos anteriores a Opus 4.7, el mismo texto produce aproximadamente un 30% más de tokens, así que no traslades una estimación de tokens de un modelo pre-4.7 sin ajustarla.
El único número que cambió: las lecturas de caché
Si solo vas a leer una sección, que sea esta. El precio de la lectura de caché bajó de $1 a $0,25 por millón de tokens, un recorte del 75%.

¿Por qué importa tanto un solo medidor? El caché de prompts permite guardar una vez un fragmento de un prompt (un prompt de sistema, un documento grande, definiciones de herramientas) y releerlo en llamadas posteriores en lugar de pagar el precio completo de entrada cada vez. En Fable 5.1, una lectura de caché ahora cuesta 0,025 veces el precio base de entrada, frente a 0,1 veces en otros modelos Claude. La longitud mínima cacheable de 512 tokens no cambia.
La razón por la que esto golpea tan fuerte en el trabajo agéntico: un agente que se ejecuta durante mucho tiempo relee su contexto en cada paso. Si tu agente necesita cuarenta llamadas a herramientas para terminar una tarea, está leyendo ese prefijo en caché cuarenta veces. Recorta el precio de esa lectura en tres cuartos y la factura total se mueve mucho, aunque las cifras principales de $10/$50 nunca cambiaron. El cambio premia exactamente el tipo de trabajo para el que se construyó Fable 5.1.
Qué significa realmente el "ahorro efectivo"
Anthropic cita dos cifras de ahorro, y conviene leerlas con cuidado en lugar de tratarlas como una sola. El recorte de la lectura de caché reduce el coste de una carga de trabajo típica en un 25% aproximadamente, y el de una carga de trabajo muy agéntica hasta en un 45%, frente a Fable 5.
Dos advertencias sobre esas cifras, porque un porcentaje solo es tan bueno como su base:
- Se miden frente a Fable 5, no frente a Opus 5 ni a ningún competidor. Es una comparación dentro del mismo modelo.
- Se midieron con esfuerzo predeterminado durante cuatro semanas de uso real en agosto de 2026 en Claude Enterprise, Claude Code y la API. Tu mezcla de tokens en caché frente a nuevos decide dónde caes en esa franja del 25 al 45%. Una carga de trabajo que apenas usa el caché apenas notará nada de esto.
Quienes lo usan en el día a día reportaron un patrón parecido. Un equipo lo resumió sin rodeos después de una semana con bucles multiagente:
"One team ran Claude Fable 5.1 for 7 days straight on multi-agent coding loops and cut token spend 25%"
Eso está en el extremo bajo de la franja, más o menos lo esperable para un bucle de código que no es intensivo en caché al máximo.
Por lotes, solo EE. UU. y los demás conceptos
Dos tarifas quedan fuera de la tabla principal y cambian los cálculos para configuraciones específicas.
El procesamiento por lotes funciona con un 50% de descuento sobre la tarifa estándar: $5 por millón de tokens de entrada y $25 por millón de salida. Si tu trabajo no es sensible a la latencia (procesamiento nocturno de documentos, clasificación masiva, evaluaciones sin conexión), esta es la palanca más grande de toda la tabla, mayor que el recorte de caché para trabajos no interactivos.
La inferencia solo en EE. UU. está disponible para cargas de trabajo con requisitos de residencia de datos, a 1,1 veces el precio de entrada y salida. Es decir, $11 de entrada / $55 de salida por millón de tokens si necesitas que cada solicitud se ejecute en EE. UU.
Claude Mythos 5.1, el mismo modelo subyacente con salvaguardas más ligeras, tiene el mismo precio que Fable 5.1. No es un nivel más económico, y está limitado a participantes del Project Glasswing (ciberdefensores y científicos de la vida verificados), así que para casi todo el mundo no es una opción de compra de todos modos.
Fable 5.1 vs Opus 5 vs Sonnet 5
Poner precio a un solo modelo de forma aislada oculta la decisión real, que es cuál Claude deberías pagar. Aquí está la familia actual, con tarifas de la API por millón de tokens, según la tabla de precios de la plataforma.

| Modelo | Entrada | Lectura de caché | Salida |
|---|---|---|---|
| Claude Fable 5.1 | $10 | $0,25 | $50 |
| Claude Opus 5 | $5 | $0,50 | $25 |
| Claude Sonnet 5 | $2 | $0,20 | $10 |
El detalle contraintuitivo: Fable 5.1 es el Claude más caro en entrada y salida base, el doble que Opus 5 y cinco veces más que Sonnet 5, pero su lectura de caché a $0,25 es la más barata de los tres, incluso por debajo de los $0,50 de Opus 5. No es casualidad. Anthropic puso precio al medidor que más golpea una sesión de agente larga, así que cuanto más agéntica sea tu carga de trabajo, más juega esa diferencia a favor de Fable.
La propia guía de Anthropic es refrescantemente directa sobre cuándo vale la pena pagar por Fable. Su documentación dice empezar con Opus 5 para la mayoría de las cargas de trabajo y recurrir a Fable 5.1 solo cuando Opus 5 con más esfuerzo sigue quedándose corto, o para los proyectos de larga duración más ambiciosos.

Al menos un desarrollador encontró convincentes por sí mismos los números con esfuerzo más bajo:
"Fable 5.1 at low effort is often competitive with Opus and Sonnet on $ / task while scoring higher. on CursorBench 3.2.0, Fable 5.1 at low effort is at parity w/ Fable 5 at high effort at a third of the cost."
El esfuerzo es la palanca que más gente pasa por alto al comparar tarifas: un modelo con esfuerzo bajo piensa menos y gasta menos tokens, así que el coste por tarea de un modelo "caro" puede ser más bajo de lo que sugiere la tarifa de etiqueta. El pensamiento adaptativo de Fable 5.1 siempre está activo y se controla con el parámetro effort, con "alto" como valor predeterminado.
Por lo que no pagas
Una parte pequeña pero real del precio de Claude Fable 5.1 es lo que ahora es gratis y que antes te costaba dinero al recibir una negativa.
Fable 5.1 redirige algunas solicitudes a modelos de salvaguarda en lugar de responder. Las consultas de ciberseguridad marcadas caen a Opus 4.8, las consultas de biología marcadas a Opus 5, y, algo crucial, no se te cobra el precio de Fable por una solicitud redirigida. También hay un crédito de respaldo que reembolsa el coste de caché de prompt por cambiar de modelo en una solicitud rechazada, y no se te cobra por una negativa que llega antes de cualquier salida.
Ese detalle de facturación importa porque las negativas son una queja habitual. Los desarrolladores se topan con falsos positivos en su propio código:
"Fable is useless. Me: "Find my security problems in my own code. This is code I own. I'm doing this under authorization of the CEO/CTO of our company." Fable: "yeah, no.""
Para ser justos con Anthropic, la tendencia va en la dirección correcta, no al revés: los usuarios de Claude Code pueden esperar alrededor de un 60% menos de intervenciones de ciberseguridad por sesión que en Fable 5, y Fable 5.1 ya puede identificar vulnerabilidades de software de forma defensiva. El punto para un presupuesto es más limitado: una negativa es molesta, pero al menos no aparece en tu factura.
Disponibilidad por plan y dónde puedes llamarlo
La tarifa por tokens es la historia de la API. Del lado del consumidor, Fable 5.1 está disponible para usuarios Pro, Max, Team y Enterprise, y no está en el nivel gratuito. Para las cifras exactas de suscripción mensual en dólares, Anthropic remite a claude.com/pricing, que es la fuente de verdad que hay que comprobar en vivo antes de citar una cifra de Pro o Max, ya que se mueven de forma independiente a las tarifas de la API anteriores.
Un matiz si estás en una suscripción en lugar de en la API: el esfuerzo predeterminado varía según la superficie. Fable 5.1 usa alto esfuerzo por defecto en Claude Code, y medio en Claude Cowork y en Claude.ai. Un esfuerzo más alto consume más tokens, lo que en parte explica por qué incluso los usuarios de Max reportan alcanzar límites de uso rápidamente en modelos de la clase Fable.
En la API, puedes llamar a claude-fable-5-1 en todas las plataformas principales: la API de Claude directamente, Amazon Bedrock y Claude Platform en AWS, Google Cloud Vertex AI y Microsoft Foundry. La tarifa es la misma sin importar desde dónde la llames.
Estima tu coste de Claude Fable 5.1
Las tablas de tarifas son abstractas hasta que introduces tus propios números. Esta calculadora toma volúmenes de tokens y la división entre entrada nueva y en caché, y devuelve una cifra mensual a tarifas de Fable 5.1, con Opus 5 y Sonnet 5 al lado para comparar. Todo se ejecuta en tu navegador, no se envía nada a ningún sitio.
Juega con el porcentaje de caché y verás el sentido completo de la actualización 5.1: pasa más de tu entrada por el caché y el total de Fable baja rápido, porque ese es el único medidor que Anthropic recortó de verdad.
El modelo es infraestructura, eesel es el compañero de equipo
Esto es lo que una tabla de tarifas no puede decirte: el precio del token no es el coste de resolver tu problema, es el coste de un ingrediente en bruto. Claude Fable 5.1 es un modelo. Para convertirlo en algo que realmente resuelva un ticket de cliente, todavía tienes que construir la recuperación de información sobre tus documentos de ayuda, barreras de seguridad para que no invente con confianza una política de reembolso, una vía de escalado a humanos y una forma de probarlo antes de que toque a un cliente real. Ese trabajo es donde vive el gasto real y el riesgo real, no en la línea de $10 frente a $50.
Ese es el hueco que llena eesel. eesel es una plataforma de compañeros de equipo con IA, y su compañero de soporte con IA llega ya sabiendo cómo hacer el trabajo: se conecta a tu helpdesk existente, se entrena con tus tickets pasados y tu base de conocimiento, y se une a la cola como un nuevo empleado. No lo ensamblas a partir de un modelo y una pila de código pegado. Y como un agente de código como Claude Code, Codex o Cursor puede manejar a ese mismo compañero a través de la CLI de eesel, la automatización que construyes se puede programar de principio a fin, no queda encerrada detrás de un panel.
La diferencia de precio es la parte que importa a quien acaba de leer toda esta tabla de tarifas. La medición por tokens es variable por diseño: una ejecución de agente muy conversadora cuesta más que una escueta, y te enteras después de los hechos. eesel, en cambio, cobra por ticket resuelto, así que la automatización de soporte se mantiene como una partida predecible sin importar cuántas veces el modelo subyacente relea su contexto. Puedes probar eesel gratis y ejecutarlo primero contra tus propios tickets históricos para ver la tasa de resolución y el coste antes de que responda a un cliente real.
Preguntas frecuentes
¿Cuánto cuesta Claude Fable 5.1 por millón de tokens?
¿Es gratuito usar Claude Fable 5.1?
¿Por qué el precio de Claude Fable 5.1 es más alto que el de Opus 5 o Sonnet 5?
¿Cuál es el descuento en las lecturas de caché de Claude Fable 5.1?
¿Cómo mantengo el precio de Claude Fable 5.1 predecible en producción?

Article by
Kurnia Kharisma Agung Samiadjie
Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.






