Precios de Claude Sonnet 5.5 en 2026: tarifas de API, planes y costes reales

Rama Adi
Escrito por

Rama Adi

Katelin Teen
Revisado por

Katelin Teen

Última edición September 29, 2026

Verificado por expertos
Ilustración dibujada a mano de un equipo revisando un medidor de costes y un gráfico de barras sobre los precios de Claude Sonnet 5.5

Resumen

Claude Sonnet 5.5 cuesta 2 $ por millón de tokens de entrada y 10 $ por millón de tokens de salida, igual que Sonnet 5 y exactamente la mitad que Claude Opus 5.5 en entrada, salida, escrituras de caché y Batch. No hay recargo por contexto largo en toda la ventana de 1M, y está incluido en el plan gratuito de Claude.

El inconveniente es la única línea que no cuesta la mitad. Las lecturas de caché cuestan 0,20 $ por millón tanto en Sonnet 5.5 como en Opus 5.5. En las pruebas de Artificial Analysis, las lecturas de caché supusieron el 40 % de la factura de Sonnet 5.5 con esfuerzo máximo, y con esa configuración costó 7,60 $ por tarea frente a los 5,98 $ de Opus 5.5. Con esfuerzo Low y Medium, Sonnet 5.5 es la opción barata y rápida que dice ser. Por encima de High, Opus 5.5 en Medium suele darte la misma puntuación por menos dinero.

En eesel yo escribo el código de integración que envía estas llamadas a la API, así que leo las tarifas por la línea que acaba en la factura. Si estás calculando el coste de Sonnet 5.5 para una cola de soporte, eesel ejecuta modelos como este dentro de un compañero de helpdesk con IA que factura por ticket gestionado, de modo que el mando del esfuerzo nunca aparece en tu factura.

Precios de Claude Sonnet 5.5 de un vistazo

Claude Sonnet 5.5 se lanzó el 28 de septiembre de 2026 y Anthropic mantuvo el precio. Esta es la tarifa completa de la API de la documentación de precios de Claude, por millón de tokens, junto a sus dos hermanos más cercanos:

Precio por 1M de tokensClaude Sonnet 5.5Claude Opus 5.5Claude Haiku 4.5
Entrada$2$4$1
Salida (razonamiento incluido)$10$20$5
Escritura de caché de 5 minutos$2.50$5$1.25
Escritura de caché de 1 hora$4$8$2
Lectura de caché$0.20$0.20$0.10
Batch entrada / salida$1 / $5$2 / $10$0.50 / $2.50
Fast modeNo disponible$8 / $40No disponible
Ventana de contexto1M1M200K
Salida máxima128K (300K en beta de Batch)128K (300K en Batch)64K
Recargo por contexto largoNingunoNingunon/a
La pestaña API de la página de precios de Claude con Sonnet 5.5 a 2 $ de entrada, 10 $ de salida, 0,20 $ de lectura de caché y 2,50 $ de escritura de caché por millón de tokens, junto a Fable 5.1, Opus 5.5 y Haiku 4.5, tomada de la página de precios de Claude
La pestaña API de la página de precios de Claude con Sonnet 5.5 a 2 $ de entrada, 10 $ de salida, 0,20 $ de lectura de caché y 2,50 $ de escritura de caché por millón de tokens, junto a Fable 5.1, Opus 5.5 y Haiku 4.5, tomada de la página de precios de Claude

Algunos detalles de esa tabla importan más de lo que parece a primera vista:

  • El razonamiento se factura como salida. Sonnet 5.5 usa razonamiento adaptativo, así que cada token de razonamiento cuesta 10 $ por millón, igual que la respuesta.
  • El esfuerzo por defecto de la API es high, según la descripción general del modelo. Las apps de Claude y Claude Code usan Medium por defecto. Ese único ajuste cambia tu factura más que cualquier otra cosa de esta página.
  • El prompt mínimo cacheable es de 512 tokens, así que incluso un prompt de sistema de soporte corto se puede cachear.
  • El tokenizador no cambia respecto a Sonnet 5, de modo que el mismo texto produce el mismo número de tokens. Cualquier ahorro viene de que el modelo escribe menos, no de un conteo más amable.

Si vienes de la generación anterior, nada en el precio de lista se movió respecto a los precios de Sonnet 5, y sigue por debajo de los 3 $ y 15 $ de Claude Sonnet 4.6. Lo que Anthropic defiende es que la factura baja igualmente, porque el modelo termina el mismo trabajo con menos tokens.

La mitad del precio de Opus en todas las líneas menos una

Esta es la parte que omiten la mayoría de los resúmenes de precios. Sonnet 5.5 cuesta exactamente la mitad que Claude Opus 5.5 en entrada, salida, escrituras de caché y Batch. En lecturas de caché no es más barato en absoluto.

Comparación dibujada a mano de las tarifas de Sonnet 5.5 y Opus 5.5 por millón de tokens, con entrada, salida, escritura de caché y salida de Batch a mitad de precio y las lecturas de caché rodeadas con un círculo al mismo precio de 0,20 $
Comparación dibujada a mano de las tarifas de Sonnet 5.5 y Opus 5.5 por millón de tokens, con entrada, salida, escritura de caché y salida de Batch a mitad de precio y las lecturas de caché rodeadas con un círculo al mismo precio de 0,20 $

Eso ocurrió porque Opus 5.5 recibió una caché inusualmente barata. Su multiplicador de lectura de caché es 0,05x de la entrada, mientras que Sonnet usa el estándar de 0,1x, según la tabla de prompt caching. La entrada de Opus cuesta 4 $, así que 0,05x da 0,20 $. La entrada de Sonnet cuesta 2 $, así que 0,1x también da 0,20 $. El mismo número por dos caminos.

Para un chatbot que envía un prompt y recibe una respuesta, esto apenas importa, pero para un agente importa bastante. Cada turno de un bucle de agente reenvía toda la conversación hasta ese momento, y con la caché activada, la mayor parte de ese reenvío se factura como lecturas de caché. Cuanto más dura la sesión, más crece esa línea, y es la única línea en la que elegir el modelo más pequeño no te ahorra nada.

La comunidad lo detectó el día del lanzamiento:

Hacker News

"Cache read is the same as Opus as well where most agentic workflow cost comes from. Not quite sure where this fits well."

Lo que cuesta realmente una ejecución real

Una tarifa te dice el precio de un token. No te dice cuántos tokens gasta un modelo para terminar un trabajo, y ahí es donde Sonnet 5.5 se vuelve interesante. Artificial Analysis ejecutó su Intelligence Index en cada nivel de esfuerzo y publicó el coste medido por tarea.

Página del modelo Claude Sonnet 5.5 en Artificial Analysis con esfuerzo máximo, mostrando un Intelligence Index de 56, 137,6 tokens de salida por segundo, 7,60 $ de coste por tarea y 410M de tokens de salida, capturada de Artificial Analysis
Página del modelo Claude Sonnet 5.5 en Artificial Analysis con esfuerzo máximo, mostrando un Intelligence Index de 56, 137,6 tokens de salida por segundo, 7,60 $ de coste por tarea y 410M de tokens de salida, capturada de Artificial Analysis

La página es contundente con el coste. Con esfuerzo máximo, Sonnet 5.5 generó 410M de tokens de salida en todo el índice frente a una mediana de su clase de 88M, y el propio resumen de AA lo califica de "very verbose". Aquí está la escalera completa de la página de Sonnet 5.5 de AA, junto a las filas equivalentes de su página de Opus 5.5:

EsfuerzoPuntuación Sonnet 5.5Coste por tarea Sonnet 5.5Tokens de salida por tareaPuntuación Opus 5.5Coste por tarea Opus 5.5
Low36$0.4113.9k42$0.55
Medium41$0.5919.5k51$1.34
High47$1.0834.5k54$1.82
Xhigh52$2.7473.7k56$3.46
Max56$7.60192.8k58$5.98

Si lees la columna de Sonnet hacia abajo, el coste se duplica más o menos en cada paso por encima de Medium, y casi se triplica al pasar de Xhigh a Max. Si lees en horizontal, el patrón se invierte alrededor de High. Sonnet 5.5 con esfuerzo máximo cuesta un 27 % más por tarea que Opus 5.5 con esfuerzo máximo, con dos puntos menos de puntuación. Usó 193k tokens de salida por tarea ahí, frente a los 119k de Opus.

Escalera dibujada a mano de niveles de esfuerzo con puntuaciones y coste por tarea de Sonnet 5.5 y Opus 5.5, con Sonnet Xhigh con 52 por 2,74 $ rodeado con un círculo frente a Opus Medium con 51 por 1,34 $
Escalera dibujada a mano de niveles de esfuerzo con puntuaciones y coste por tarea de Sonnet 5.5 y Opus 5.5, con Sonnet Xhigh con 52 por 2,74 $ rodeado con un círculo frente a Opus Medium con 51 por 1,34 $

La pareja en la que yo me fijaría es Sonnet Xhigh frente a Opus Medium. Puntúan 52 y 51, y Opus cuesta 1,34 $ frente a los 2,74 $ de Sonnet. Si te encuentras subiendo Sonnet 5.5 por encima de High para conseguir la calidad que necesitas, acabas pagando más de lo que pagarías por el modelo grande en su configuración por defecto.

Esta es también la lectura honesta de la afirmación de Anthropic de "hasta un 30 % menos por tarea". La publicación de lanzamiento dice que Sonnet 5.5 "complements Opus 5.5 best when running at lower effort settings, where it costs less per task. At higher settings, it can perform comparably at a similar cost." Los números de AA lo confirman al pie de la letra.

Adónde va el dinero en la factura de un agente

AA también desglosa el coste de cada ejecución por tipo de token, y aquí es donde la línea de lectura de caché de antes deja de ser teórica. En la ejecución completa del Intelligence Index con esfuerzo máximo, la factura de Sonnet 5.5 fue de 8.977 $:

Barra apilada dibujada a mano que divide la factura de benchmark de 8.977 $ de Sonnet 5.5 con esfuerzo máximo en lecturas de caché 3.605 $, escrituras de caché 1.195 $, entrada nueva 71 $ y salida más razonamiento 4.106 $, con las lecturas de caché anotadas como facturadas a la tarifa de Opus
Barra apilada dibujada a mano que divide la factura de benchmark de 8.977 $ de Sonnet 5.5 con esfuerzo máximo en lecturas de caché 3.605 $, escrituras de caché 1.195 $, entrada nueva 71 $ y salida más razonamiento 4.106 $, con las lecturas de caché anotadas como facturadas a la tarifa de Opus
ConceptoSonnet 5.5 en MaxPorcentajeSonnet 5.5 en MediumPorcentaje
Lecturas de caché$3,60540%$18026%
Escrituras de caché$1,19513%$15522%
Entrada nueva$711%$7010%
Salida y razonamiento$4,10646%$29542%
Total$8,977$701

De aquí saltan a la vista dos cosas. La entrada nueva, la línea que la mayoría imagina al pensar en "tokens de entrada", es casi nada, porque casi todos los tokens de entrada en una ejecución de agente son una lectura o una escritura de caché. Y las lecturas de caché, la línea sin descuento en Sonnet, pasan de una cuarta parte de la factura en Medium al 40 % en Max, porque pensar más tiempo significa más turnos y más relecturas.

Si pones ambos modelos lado a lado en la misma ejecución, la brecha se cierra, que es la misma historia que contaba la comparativa anterior de Opus 5 vs Sonnet 5. En Medium, la ejecución del índice con Sonnet 5.5 costó 701 $ frente a los 1.627 $ de Opus 5.5, así que Sonnet fue el 43 % de la factura de Opus. En Max, Sonnet costó 8.977 $ frente a los 8.708 $ de Opus. La mitad del precio de lista, un 3 % más en la factura.

Ejemplos resueltos con tres tipos de carga de trabajo

Los benchmarks son la carga de trabajo de otro, así que aquí va la cuenta según la tarifa para tres formas habituales, usando solo los precios publicados. Toma los recuentos de tokens como ilustrativos y pon los tuyos en la calculadora de abajo.

1. Un bot de respuestas de soporte. Cada respuesta envía 8.000 tokens de entrada, 6.000 de ellos un prompt de sistema y artículos de ayuda en caché, y recibe 1.500 tokens de vuelta incluyendo el razonamiento.

  • Sonnet 5.5: 0,004 $ de entrada nueva + 0,0012 $ de lecturas de caché + 0,015 $ de salida = unos 2 céntimos por respuesta, o 202 $ por 10.000 tickets
  • Opus 5.5: 0,008 $ + 0,0012 $ + 0,03 $ = unos 3,9 céntimos, o 392 $ por 10.000
  • Haiku 4.5: 0,002 $ + 0,0006 $ + 0,0075 $ = alrededor de 1 céntimo, o 101 $ por 10.000

Aquí domina la salida, así que la mitad de precio de Sonnet en salida se traslada casi por completo. Esta es la forma en la que Sonnet 5.5 es claramente mejor compra que Opus. Para ver el panorama más amplio de lo que cuesta el soporte con IA más allá del modelo, consulta la guía de coste del servicio de atención al cliente con IA.

2. Una sesión larga de agente. Imagina un agente de programación u operaciones que ejecuta 30 turnos, relee un contexto de 60.000 tokens desde la caché en cada turno, añade 3.000 tokens nuevos y escribe 2.000 por turno.

  • Sonnet 5.5: 0,36 $ de lecturas de caché + 0,18 $ de entrada nueva + 0,60 $ de salida = 1,14 $
  • Opus 5.5: 0,36 $ + 0,36 $ + 1,20 $ = 1,92 $

Ahora supón que Sonnet necesita 40 turnos donde Opus necesita 25, que es la dirección que apuntan los recuentos de tokens de AA con más esfuerzo. Sonnet pasa a 0,48 $ + 0,24 $ + 0,80 $ = 1,52 $, y Opus pasa a 0,30 $ + 0,30 $ + 1,00 $ = 1,60 $. El modelo de "mitad de precio" queda ahora a 8 céntimos del caro.

3. Un trabajo Batch nocturno. Extraes campos de 10.000 documentos con 20.000 tokens de entrada y 1.000 de salida cada uno, y nada necesita respuesta en tiempo real.

  • Sonnet 5.5 en Batch: 200 $ de entrada + 50 $ de salida = 250 $
  • Opus 5.5 en Batch: 400 $ + 100 $ = 500 $
  • Haiku 4.5 en Batch: 100 $ + 25 $ = 125 $

No hay relecturas de caché ni bucle de agente, así que la proporción de 2x se mantiene bastante limpia. Batch además se puede combinar con el prompt caching, según la documentación de precios.

Calcula tu propia factura mensual

Define el número de tokens por tarea de tu carga de trabajo y mira lo que cuesta cada modelo al mes. Las escrituras de caché se dejan fuera por simplicidad, ya que con una caché caliente son una parte pequeña de una carga estable.

Si el preset de agente te sorprende, es la línea de lectura de caché haciendo su trabajo. Con 1,8M de tokens en caché por sesión, Sonnet y Opus pagan los mismos 0,36 $ por las relecturas, y solo la línea de salida los mantiene separados.

El esfuerzo es el mando del precio, y el valor por defecto de la API es high

Anthropic te deja fijar el esfuerzo por solicitud, y es la palanca más grande sobre una factura de Sonnet 5.5. Simon Willison ejecutó el mismo prompt de SVG en cada nivel y publicó los costes en el hilo del lanzamiento:

EsfuerzoCoste de un promptTiempo
Low1,6 céntimos10s
Medium1,8 céntimos11s
High2,3 céntimos17s
Xhigh5,7 céntimos41s
Max$1.2815m 40s, y falló

En Max, el modelo, en sus palabras, "burned through 128,000 thinking tokens (taking 15 minutes to do that) and ran out before it had produced the final SVG". Eso es un salto de coste de 80 veces de Low a Max para un resultado peor.

Mi consejo práctico, como alguien que integra estas llamadas en código de producción:

  1. Fija el esfuerzo de forma explícita en cada solicitud. El valor por defecto de la API es high, no el Medium que ves en las apps, así que una integración ingenua empieza un escalón por encima de la zona barata.
  2. Empieza en Low para el trabajo rutinario como clasificación, etiquetado y respuestas cortas, y sube solo donde tus evaluaciones muestren una brecha real.
  3. Trata Xhigh y Max como una señal para cambiar de modelo. Pasado High, Opus 5.5 en Medium tiende a superar a Sonnet en puntuación y en precio.
  4. Repite tus pruebas de esfuerzo si migras desde Sonnet 5. Anthropic recalibró los niveles en la página de novedades, así que los ajustes antiguos no se trasladan.

La ventaja es grande en la parte baja del dial. AA midió Sonnet 5.5 en Medium con una puntuación de 41 por 0,59 $ por tarea, frente a Claude Sonnet 5 en Max con una puntuación de 38 por 5,09 $. Es un mejor resultado por aproximadamente una novena parte del coste, que es la historia de mejora que vende Anthropic, y se sostiene.

Descuentos, extras y las partidas pequeñas

Más allá del esfuerzo, cuatro modificadores cambian el precio por token, todos de la documentación de precios de Claude:

ModificadorEfecto en Sonnet 5.5Notas
Prompt cachingLecturas a $0.20 (0,1x), escrituras a $2.50 (5 min) o $4 (1 hora)Se amortiza tras una lectura en la caché de 5 minutos
API Batch50 % de descuento: $1 de entrada, $5 de salidaSe combina con el caching; 300K de salida con un header beta
Inferencia solo en EE. UU.1,1x en cada categoría de tokenSe activa con inference_geo: "us"
Fast modeNo disponibleSolo Opus 5.5, a $8 / $40

Las tarifas de herramientas se suman a los tokens. La búsqueda web cuesta 10 $ por cada 1.000 búsquedas, web fetch no tiene coste extra, y la ejecución de código es gratis cuando se usa junto con búsqueda o fetch web; si no, hay 1.550 horas de contenedor gratis al mes y luego 0,05 $ por hora. Sonnet 5.5 añade 286 tokens de prompt de sistema siempre que hay herramientas presentes. Las sesiones de Claude Managed Agents añaden 0,08 $ por hora de sesión en ejecución sobre las tarifas estándar de tokens.

Un coste fácil de pasar por alto: el uso forzado de herramientas (tool_choice con any o una herramienta concreta) ahora devuelve un 400 en Sonnet 5.5, según las notas de migración. No es un precio, pero si tu bot de soporte dependía de ello, el retrabajo es un coste real del cambio. La publicación principal repasa los cinco cambios incompatibles.

Claude Free, Pro, Max, Team y Enterprise

Si usas Sonnet 5.5 en las apps de Claude en lugar de la API, pagas por puesto, no por token. Desde la página de precios de Claude:

PlanPrecioAcceso a Sonnet 5.5Notas
Free$0SíAnthropic dice "anyone can chat with Claude using Sonnet 5.5"
Pro$17/mes con facturación anual, $20 mensualSíAñade Opus y créditos de uso
Max 5x / 20xDesde $100/mesSí5x o 20x el uso de Pro, acceso prioritario
Team estándar$20/puesto/mes anual, $25 mensualSíPara 2 a 150 personas
Team premium$100/puesto/mes anual, $125 mensualSí5x el uso del puesto estándar
Enterprise$20/puesto/mes más uso a tarifas de APISíEl uso se factura a las tarifas por token de arriba

Dos cosas cambian la cuenta aquí. En Free y Pro, Sonnet es el modelo que la mayoría usará de verdad, y los usuarios gratuitos ahora tienen Sonnet 5.5. En Enterprise, la cuota por puesto es solo el comienzo, porque el uso se factura a las mismas tarifas de API que este artículo entero. La guía de precios de Claude y el desglose de Claude Pro cubren los límites de uso, y la guía de precios de Claude Code cubre el lado del desarrollador, donde el esfuerzo Medium es el valor por defecto.

Un desarrollador el día del lanzamiento resumió bien la división entre suscripción y API:

Hacker News

"Sonnet 5.5 might not be useful or necessary in a Claude Code session but it could be good value in the API when you pay per token."

Bedrock, Google Cloud y Foundry

Sonnet 5.5 salió en todas las nubes principales el primer día, como anthropic.claude-sonnet-5-5 en Amazon Bedrock y claude-sonnet-5-5 en Google Cloud y Microsoft Foundry, según la descripción general del modelo. Cómo te facturan depende de la puerta por la que entres:

  • Amazon Bedrock y Google Cloud los opera el socio. Te facturan directamente a sus propias tarifas publicadas, así que revisa los precios de Bedrock antes de dar por hecha la paridad. Google también publica sus propias tarifas de Vertex AI.
  • Claude Platform on AWS y Claude in Microsoft Foundry los opera Anthropic. Valoran tu uso a los precios estándar de Anthropic, aplican cualquier descuento negociado y lo convierten a Claude Consumption Units a 0,01 $ cada una, facturadas por horas a mes vencido a través del marketplace.
  • La inferencia solo en EE. UU. lleva el mismo multiplicador de 1,1x en la API propia, Claude Platform on AWS y los despliegues de US Data Zone de Foundry.

Si ya ejecutas Claude a través de una nube, la guía de Bedrock y la guía de Vertex AI cubren la configuración.

Cómo se compara Sonnet 5.5 con GPT-6 Sol y Gemini 3.8 Flash

La comparación más llamativa no está dentro de la gama de Anthropic. GPT-6 Sol tiene una tarifa principal idéntica: 2 $ de entrada, 10 $ de salida, 0,20 $ de entrada en caché, 2,50 $ de escritura de caché, según el desglose de los precios de GPT-6 Sol.

Por 1M de tokensClaude Sonnet 5.5GPT-6 SolGemini 3.8 Flash
Entrada$2$2$0.75 (sube a $1.50 el 1 ene. 2027)
Salida$10$10$3.75 (sube a $7.50)
Lectura de caché$0.20$0.20$0.075
Prima por contexto largoNinguna hasta 1MTarifa mayor por encima de 272K de entradaNinguna
Coste por tarea en AA (configuración)$1.08 (high)$1.05 (max)No comparable
AA Intelligence Index47 (high)48 (max)No comparable

Las filas de AA lo delatan. Sonnet 5.5 en High y GPT-6 Sol en max quedan con casi la misma puntuación por casi el mismo coste por tarea. La diferencia está más en los extremos: Sonnet no tiene recargo por contexto largo, así que un agente de soporte que carga una gran base de conocimiento en el contexto no cruza un precipicio de precio, y Sol sí lo hace por encima de 272K. Las cifras de AA de Gemini venían de una versión anterior del índice, así que las dejé fuera de la comparación directa, y los precios de Gemini 3.8 Flash se duplican en enero. La comparativa de tres APIs profundiza más si estás eligiendo proveedor en lugar de modelo.

Para tickets de soporte en concreto, la clasificación depende menos del precio que de la fiabilidad con tus propios datos, por lo que el ranking de modelos para tickets de soporte pone la precisión primero.

Lo que dicen los desarrolladores sobre el precio

La reacción el día del lanzamiento en Hacker News giró sobre todo en torno a dónde se sitúa frente a Opus. La postura escéptica:

Hacker News

"I feel like sonnet is priced too close to opus right now. If Sonnet 5.5 were half its current price it would make sense to use."

La postura mesurada, que coincide con la escalera de AA de arriba:

Hacker News

"Per the charts, there is largely no point to using Sonnet 5.5 at high+ as opus low generally will give similar performance at similar or lower cost."

Y la entusiasta, de un usuario que lo compara con el modelo estrella de OpenAI en una configuración más baja:

Reddit

"Sonnet 5.5 medium scores better than gpt 5.6 Sol high and is less than 1/5 the cost Absolutely bonkers"

El patrón al que la gente llegaba una y otra vez era una configuración dividida: Sonnet 5.5 en Low o Medium haciendo el trabajo de alto volumen como subagente, con Opus 5.5 orquestando o rematando las partes difíciles. Si ninguna de las dos opciones te encaja, el repaso de alternativas a Claude cubre otras rutas. Eso encaja con los precios, ya que el descuento de Sonnet es real en llamadas con mucha salida y contexto corto, y se difumina en bucles largos y cargados de caché.

¿Vale la pena Claude Sonnet 5.5 a 2 $ y 10 $?

Sí, con esfuerzo Low y Medium, y ahí no lo dudaría. Supera la mejor puntuación de Sonnet 5 por una fracción del coste, cuesta la mitad que Opus en la línea de salida que domina las cargas tipo chat, y no tiene recargo por contexto largo. Para un bot de respuestas de soporte, un clasificador, un paso de redacción o un trabajo Batch nocturno, es el que elegiría por defecto.

Es una compra más débil en dos casos. Si tu carga es un bucle largo de agente, las lecturas de caché se comen el descuento porque cuestan lo mismo en ambos modelos. Y si necesitas Xhigh o Max para conseguir la calidad que quieres, Opus 5.5 en Medium suele ser más barato por la misma puntuación. Prueba Sonnet en Low primero, mide, y luego decide si la diferencia justifica 1,34 $ por tarea.

Si el trabajo es una cola de soporte, hay un coste más que pertenece a la cuenta: planificar un gasto que se mueve con el esfuerzo y el volumen. Un comprador en las llamadas de ventas de eesel llegó a 200 interacciones en un solo día de prueba y se preocupó de inmediato por los costes por interacción a escala. Las facturas por tokens hacen esa preocupación más difícil de responder, porque el mismo ticket puede costar 1,6 céntimos o 1,28 $ según un ajuste.

Prueba eesel para una factura fija por ticket

Sonnet 5.5 es el motor. Si lo que quieres son tickets respondidos, eesel es el empleado: un compañero de helpdesk con IA que se conecta a Zendesk, Freshdesk, Gorgias y tus otras herramientas, aprende de tus tickets pasados y tu centro de ayuda, y te deja simularlo con tickets históricos antes de que responda a un cliente real. Nunca eliges un nivel de esfuerzo ni vigilas las lecturas de caché. Los precios de eesel son un plan fijo mensual de créditos donde un ticket o un chat gestionado es un crédito, desde 299 $ por 500 créditos, con un nivel gratuito de 100 créditos para probar.

Si trabajas desde una terminal, el CLI de eesel maneja al mismo compañero. Puedes conectar integraciones y editar sus instrucciones permanentes, y también aprobar o denegar acciones y leer su registro de actividad como JSON. Los agentes de programación como Claude Code también pueden ejecutarlo, a través del servidor MCP del workspace.

Panel de eesel que muestra la actividad de tickets de Zendesk del compañero de helpdesk con IA
Panel de eesel que muestra la actividad de tickets de Zendesk del compañero de helpdesk con IA

Prueba eesel y mira lo que cuesta tu cola por ticket en lugar de por token.

Preguntas frecuentes

¿Cuánto cuesta Claude Sonnet 5.5 por millón de tokens?
El precio de Claude Sonnet 5.5 en la API de Claude es de 2 $ por millón de tokens de entrada y 10 $ por millón de tokens de salida. Las lecturas de caché cuestan 0,20 $, las escrituras de caché de 5 minutos 2,50 $ y las de 1 hora 4 $. Los tokens de razonamiento se facturan como salida. La lista completa está en la guía de precios de la API de Anthropic.
¿Es Claude Sonnet 5.5 más caro que Claude Sonnet 5?
No. La tarifa es idéntica a los precios de Sonnet 5, 2 $ y 10 $, con el mismo tokenizador. Anthropic afirma que cuesta hasta un 30 % menos por tarea porque termina con menos tokens, y Artificial Analysis midió que Sonnet 5.5 con esfuerzo medio supera a Sonnet 5 con esfuerzo máximo por aproximadamente una novena parte del coste por tarea.
¿Cuesta Claude Sonnet 5.5 la mitad que Claude Opus 5.5?
En entrada, salida, escrituras de caché y Batch, sí. En lecturas de caché, no: ambos cuestan 0,20 $ por millón. Las cargas de trabajo de agentes gastan buena parte de su factura en lecturas de caché, así que la diferencia real por tarea suele ser menor que 2x. Consulta los precios de Claude Opus 5.5 para ver el otro lado de la comparación.
¿Cuál es la forma más barata de usar Claude Sonnet 5.5?
Mantén el esfuerzo en Low o Medium, cachea tu prompt de sistema estable y manda todo lo que pueda esperar por la API Batch a 1 $ y 5 $. Esas tres palancas reducen el coste de Claude Sonnet 5.5 mucho más que cualquier elección de plan. Para tickets más sencillos, Haiku 4.5 cuesta otra vez la mitad.
¿Puedo usar Claude Sonnet 5.5 gratis?
Sí, en las apps de Claude. Sonnet está incluido en el plan Free, y Anthropic dice que cualquiera puede chatear con Sonnet 5.5 en Claude.ai. Los planes de pago añaden más uso, empezando por Pro a 17 $ al mes con facturación anual. La guía de precios de Claude Pro explica los límites.
¿Cobra Claude Sonnet 5.5 un extra por contexto largo?
No. La ventana de contexto completa de 1M de tokens se factura a la tarifa estándar, así que una solicitud de 900k tokens paga lo mismo por token que una de 9k. Eso difiere de los precios de GPT-6 Sol, que pasa a una tarifa de contexto largo más alta por encima de 272K tokens de entrada.
¿Cuánto cuesta Claude Sonnet 5.5 en Amazon Bedrock o Google Cloud?
Sonnet 5.5 está en Bedrock, Google Cloud y Microsoft Foundry desde el primer día, pero las nubes asociadas te facturan a sus propias tarifas publicadas. Claude Platform on AWS y Claude in Foundry facturan a las tarifas estándar de Anthropic convertidas a unidades de consumo a 0,01 $ cada una. La inferencia solo en EE. UU. añade un multiplicador de 1,1x. La guía de configuración de Bedrock cubre la parte técnica.
¿Cuánto costaría Claude Sonnet 5.5 para un bot de atención al cliente?
Con un prompt de 8.000 tokens (6.000 en caché) y 1.500 tokens de salida, una respuesta cuesta unos 2 céntimos, o aproximadamente 200 $ por 10.000 tickets antes de las escrituras de caché. El nivel de esfuerzo mueve esa cifra más que cualquier otra cosa. Si prefieres pagar por ticket en lugar de por token, los precios de eesel facturan cada ticket gestionado como un crédito.

Share this article

Rama Adi

Article by

Rama Adi

Rama is a software engineer at eesel AI with two years of experience writing about B2B SaaS, AI tools, and customer support technology. Based in Bali, Indonesia, he brings a developer's perspective to product comparisons — cutting through marketing copy to what the integrations and APIs actually do.

Related Posts

All posts →
Illustration of a Claude Opus 5 pricing breakdown showing cost per million tokens
Guides

Precios de Claude Opus 5 en 2026: costos de API, planes y facturas reales

Anthropic mantuvo Opus 5 a los precios de Opus 4.8, pero ahora el thinking viene activado por defecto. Esto es lo que realmente cuesta ejecutar Claude Opus 5 una vez que entran en juego el effort y el cacheo.

Rama AdiRama AdiJul 27, 2026
Una ilustración que compara Claude Mythos 5.1 y Fable 5.1 como el mismo modelo subyacente detrás de distintas capas de seguridad
Trending

Reseña de Claude Mythos 5.1: ¿vale la pena perseguir el modelo frontera bloqueado de Anthropic?

Una reseña práctica de Claude Mythos 5.1: qué es, cómo se compara con Fable 5.1, el precio real de la lectura de caché, quién puede acceder realmente y qué usaría yo en su lugar.

Kurnia KharismaKurnia KharismaSep 8, 2026
Una ilustración de la puerta de una bóveda siendo abierta por una pequeña lista aprobada de investigadores, que representa el acceso solo por invitación a Claude Mythos 5.1
Trending

Claude Mythos 5.1: qué es, quién tiene acceso y qué usar en su lugar

Claude Mythos 5.1 se lanzó el 1 de septiembre de 2026, y casi nadie puede usarlo. Aquí está la ficha técnica real, los dos programas de acceso y el modelo que deberías usar en la práctica.

KiraKiraSep 2, 2026
Dos personas revisando medidores de tokens, tarjetas de precio por millón de tokens y una larga factura impresa
Trending

Precios de la API de Anthropic en 2026: todas las tarifas y las palancas reales de coste

La tarifa completa de la API de Anthropic para cada modelo Claude, más los cuatro multiplicadores que deciden tu factura real: caché, batch, effort y dos recargos.

Kurnia KharismaKurnia KharismaAug 13, 2026
Una guía completa de los precios de Chatling en 2025
Guides

Una guía completa de los precios de Chatling en 2026

¿Considerando Chatling? Nuestra guía de 2025 desglosa los planes de precios de Chatling, analiza su confuso sistema de créditos de IA y explora las limitaciones clave de sus funciones.

Kenneth PanganKenneth PanganNov 11, 2025
Una guía práctica de Claude Code empresarial: Planes, precios y desafíos
Guides

Una guía práctica de Claude Code empresarial: Planes, precios y desafíos

¿Estás pensando en implementar Claude Code para tu equipo de desarrollo? Esta guía desglosa todo lo que necesitas saber sobre Claude Code empresarial, desde precios y planes hasta preocupaciones de seguridad y limitaciones de flujo de trabajo.

Stevia PutriStevia PutriOct 3, 2025
Una guía práctica para la nueva función de creación de archivos de Claude.
Guides

Una guía práctica para la nueva función de creación de archivos de Claude.

Claude de Anthropic ahora crea archivos como hojas de Excel y presentaciones de PowerPoint. Útil para tareas rápidas, pero arriesgado para la automatización crítica para el negocio. Aquí está el desglose completo.

Kenneth PanganKenneth PanganSep 15, 2025
Una guía práctica para la API de Perplexity AI: lo que debes saber antes de construir.
Guides

La API de Perplexity AI: Lo que debes saber antes de construir (2026)

La API de Perplexity AI ofrece respuestas en tiempo real con citas, pero los costos ocultos y los problemas de fiabilidad la hacen arriesgada para el soporte. Descubre por qué las plataformas de IA integradas funcionan mejor.

Kenneth PanganKenneth PanganSep 4, 2025
¿Qué le pasó a Claude 2.0? Una visión completa.
Guides

¿Qué pasó con Claude 2.0? Un overview completo (2026)

Claude 2.0 avanza en la IA conversacional con un mejor razonamiento, seguridad y escalabilidad, lo que lo hace ideal para interacciones comerciales y cotidianas.

Stevia PutriStevia PutriSep 8, 2025

Listo para contratar tu companero de IA?

Configuracion en minutos. Sin tarjeta de credito requerida.

Comienza gratis