Reseña de Claude Sonnet 5.5: excelente en Medium, una trampa en Max

Kira
Escrito por

Kira

Katelin Teen
Revisado por

Katelin Teen

Última edición September 29, 2026

Verificado por expertos
Ilustración dibujada a mano de un analista en su escritorio con un cuadro de puntuación de estrellas, un indicador de velocidad y pilas de libros de código y tickets de soporte, para una reseña de Claude Sonnet 5.5

Mi veredicto de un vistazo

El día después del lanzamiento lo dediqué a leer el anuncio de Anthropic y la documentación del modelo, luego la guía de migración, y también el hilo de lanzamiento en Hacker News de unos 550 comentarios. Mi trabajo es construir agentes de IA para el compañero de helpdesk de eesel, así que revisé todo con una pregunta en mente: ¿pondría este modelo mañana bajo una cola de soporte real?

La página de documentación de la plataforma Claude para Claude Sonnet 5.5, con la ventana de contexto de 1M, 128K de salida máxima, precios de 2 $ y 10 $ por millón de tokens y una comparación con Fable 5.1, Opus 5.5 y Haiku 4.5, tomada de la documentación de la plataforma Claude
La página de documentación de la plataforma Claude para Claude Sonnet 5.5, con la ventana de contexto de 1M, 128K de salida máxima, precios de 2 $ y 10 $ por millón de tokens y una comparación con Fable 5.1, Opus 5.5 y Haiku 4.5, tomada de la documentación de la plataforma Claude

Aquí va la versión corta, puntuada según lo que importa cuando lo pones en producción:

Qué comprobéNotaPor qué
Calidad de código9/1070,6 % en Terminal-Bench 4.0, por encima de Opus 5.5
Trabajo de conocimiento8/10GDPval-AA 1844, dos puntos por debajo del 1846 de Opus 5.5
Eficiencia de tokens9/10 en Low/Medium, 4/10 en Max~121k frente a 497k tokens por respuesta en Balyasny, pero 193k por tarea en Max
Velocidad8/10Salida un 30 %+ más rápida que Sonnet 5
Dolor de migración5/10Cinco cambios incompatibles, uno de ellos muy molesto para bots de soporte
Encaje en soporte8/10Zendesk vio tickets procesados un 20 % más rápido
Global8/10La mejor relación calidad-precio de la gama, con un ajuste caro que evitar

Una nota rápida sobre el método, para que quede claro en qué se apoyan estas notas. No hice una prueba de meses en producción, ya que el modelo tiene solo un día. Las notas se construyen con las cifras publicadas por Anthropic y los resultados de clientes con nombre en el anuncio de lanzamiento, más ejecuciones de benchmarks independientes que la gente publicó, y mi propia lectura de la documentación de la API frente a cómo eesel conecta modelos en los flujos de tickets. Cuando una cifra viene de Anthropic, lo digo.

Qué es Claude Sonnet 5.5

Claude Sonnet 5.5 es el modelo de gama media de la familia Claude 5.5 de Anthropic, lanzado el 28 de septiembre de 2026. Se sitúa por debajo de Claude Opus 5.5 y por encima de Haiku 4.5, mientras que Claude Fable 5.1 ocupa lo más alto de la gama. Anthropic lo presenta como "a faster, lower-cost complement" de Opus, más fuerte en "well-scoped everyday tasks, fixing bugs, and creating polished documents, slides, and spreadsheets."

En cuanto a especificaciones, la descripción del modelo indica una ventana de contexto de 1M de tokens y 128K de salida máxima (300K en Batch), con fecha de corte de conocimiento de junio de 2026 y el mismo tokenizador que Claude Sonnet 5. Para el recorrido completo del lanzamiento, el resumen de Sonnet 5.5 de mi colega lo cubre bien. Esta entrada es más bien el veredicto.

Dónde destaca Claude Sonnet 5.5

Tres cosas sobresalieron en los datos del lanzamiento, y las tres aparecen en resultados de clientes con nombre, no solo en los gráficos de Anthropic.

Programa como un modelo Opus

La cifra principal es Terminal-Bench 4.0, una prueba de programación agéntica que se ejecuta en línea de comandos. Sonnet 5 obtuvo 10,3 % y Sonnet 5.5 obtiene 70,6 %, por encima del 66,4 % de Opus 5.5. No es una errata. Es el mayor salto entre generaciones que he visto en un modelo Sonnet hasta ahora.

La tabla de benchmarks de lanzamiento de Anthropic que compara Sonnet 5.5, Sonnet 5, Opus 5.5 y GPT-6 Sol en Terminal-Bench 4.0, FrontierCode, CursorBench, GDPval-AA, AA-Briefcase, Humanity's Last Exam, OSWorld y Chartography, tomada del anuncio de Anthropic
La tabla de benchmarks de lanzamiento de Anthropic que compara Sonnet 5.5, Sonnet 5, Opus 5.5 y GPT-6 Sol en Terminal-Bench 4.0, FrontierCode, CursorBench, GDPval-AA, AA-Briefcase, Humanity's Last Exam, OSWorld y Chartography, tomada del anuncio de Anthropic

En las otras pruebas de código queda un poco por detrás de Opus: CursorBench 4.0 es 55,5 % frente a 57,8 %, y FrontierCode es 52,1 % en Xhigh frente a 54,4 %. Para un modelo a la mitad de precio por token, una diferencia de dos puntos es sinceramente una ganga. Por eso mismo, en el debate Opus vs Sonnet la gente dejó en su mayoría de discutir la calidad y pasó a discutir el coste.

Las cifras de clientes también lo respaldan. Base44 dijo que en 118 construcciones de apps reales, Sonnet 5.5 "produced apps that scored level with Opus 5" en 3,6 iteraciones por build, donde Opus 5 necesitó 7,7. Unity afirma que completó el 90 % de las tareas en su benchmark de editor de varios pasos. Y si programas en Claude Code, este es ahora el modelo que verás por defecto en esfuerzo Medium.

Llega con muchos menos tokens

El precio por token no cambió; lo que cambió es el número de tokens. Balyasny Asset Management ejecutó 2.441 tareas financieras y encontró que Sonnet 5.5 usó unos 121k tokens por respuesta, donde Sonnet 5 usó 497k. En sus evaluaciones de Slackbot, Slack vio un 14 % menos de tokens de salida sin cambios de prompt, y Lovable, por su parte, reportó un tercio menos de llamadas a herramientas.

La propia demo de Anthropic apunta a lo mismo. Con un prompt de "wind shaping sand dunes", Sonnet 5 seguía escribiendo código cuando Sonnet 5.5 ya tenía una animación funcionando:

Sonnet 5 todavía escribiendo su programa de dunas de arena a mitad de la prueba lado a lado, tomada del anuncio de Sonnet 5.5 de Anthropic
Sonnet 5 todavía escribiendo su programa de dunas de arena a mitad de la prueba lado a lado, tomada del anuncio de Sonnet 5.5 de Anthropic
La animación terminada de dunas de arena de Sonnet 5.5 en marcha en la misma prueba lado a lado, de la comparación de lanzamiento de Anthropic
La animación terminada de dunas de arena de Sonnet 5.5 en marcha en la misma prueba lado a lado, de la comparación de lanzamiento de Anthropic

Esa eficiencia es en realidad el producto. Según Anthropic, el resultado es "up to 30% less per task" que Sonnet 5. Con los equipos con los que hablo, menos tokens también significa menos segundos de espera del cliente por una respuesta, y eso les importa más que la factura.

Maneja bien los tickets de soporte

Esta es la parte que más me importa. El Director of AI de Zendesk dijo en el anuncio de lanzamiento que "fed Claude Sonnet 5.5 hundreds of real support use cases across replies and escalation requests. It made fewer wrong decisions," y los tickets se procesaron un 20 % más rápido. Por el lado de Atlassian, la empresa dice que los agentes Rovo funcionarán hasta un 30 % más rápido que con Sonnet 5.

Para trabajo al estilo Zendesk AI, esas dos son las cifras que deciden si un modelo es bueno: menos decisiones erróneas de escalado y menos espera. Ambas se movieron en la dirección correcta.

Cuadro de puntuación dibujado a mano para Claude Sonnet 5.5 con dos columnas: dónde gana (Terminal-Bench 4.0 con 70,6 %, 121k frente a 497k tokens por respuesta y tickets de soporte un 20 % más rápidos) y dónde flaquea (Max a 7,60 $ frente a 5,98 $ de Opus por tarea, se detiene a preguntar al usuario y las tareas de ciberseguridad recurren a Sonnet 5)
Cuadro de puntuación dibujado a mano para Claude Sonnet 5.5 con dos columnas: dónde gana (Terminal-Bench 4.0 con 70,6 %, 121k frente a 497k tokens por respuesta y tickets de soporte un 20 % más rápidos) y dónde flaquea (Max a 7,60 $ frente a 5,98 $ de Opus por tarea, se detiene a preguntar al usuario y las tareas de ciberseguridad recurren a Sonnet 5)

Dónde se queda corto Claude Sonnet 5.5

Los puntos débiles son más acotados de lo que sugieren los escépticos, pero uno de ellos cambia cómo deberías ejecutar el modelo.

El esfuerzo Max cuesta más que Opus

Este es el hallazgo que cambió mi veredicto. El propio anuncio de Anthropic admite que Sonnet 5.5 "complements Opus 5.5 best when running at lower effort settings" y que "at higher settings, it can perform comparably at a similar cost." Las ejecuciones independientes van un paso más allá.

En Artificial Analysis, como señaló un usuario de Reddit, Sonnet 5.5 en Max cuesta 7,60 $ por tarea frente a 5,98 $ de Opus 5.5 en Max, porque usó 193k tokens por tarea donde Opus usó 119k. Simon Willison ejecutó el día del lanzamiento el mismo prompt de SVG en todos los niveles de esfuerzo. Low costó 1,6 centavos y tardó 10 segundos. Max costó 1,28 $ y duró 15 minutos 40 segundos, gastando sus 128.000 tokens de pensamiento completos antes de fallar al producir la imagen.

Escalera dibujada a mano de cinco niveles de esfuerzo para el mismo prompt de SVG: Low a 1,6 centavos y 10 s, Medium a 1,8 centavos y 11 s, High a 2,3 centavos y 17 s marcado como punto óptimo, Xhigh a 5,7 centavos y 41 s, y Max a 1,28 $ y 15 min 40 s, tachado por fallar al quedarse sin tokens de pensamiento
Escalera dibujada a mano de cinco niveles de esfuerzo para el mismo prompt de SVG: Low a 1,6 centavos y 10 s, Medium a 1,8 centavos y 11 s, High a 2,3 centavos y 17 s marcado como punto óptimo, Xhigh a 5,7 centavos y 41 s, y Max a 1,28 $ y 15 min 40 s, tachado por fallar al quedarse sin tokens de pensamiento

Incluso la nota al pie de FrontierCode de Anthropic tiene la misma forma. Sonnet 5.5 obtiene 52,1 % en Xhigh pero solo 46,2 % en Max, porque en Max "more often ran Claude Code's code-review skill", lo que provocó tiempos de espera agotados o ediciones fuera del alcance de la tarea. Pensar más, en este caso, empeoró el resultado.

Así que la regla es simple: trata Max como prohibido para Sonnet 5.5. Una tarea que necesita tanto razonamiento es una tarea para Opus 5.5, que llega con menos tokens.

Opus sigue siendo mejor en criterio abierto

Anthropic es bastante franca en este punto: "Opus 5.5 remains clearly stronger at complex, open-ended work requiring sustained judgment." Los primeros informes de uso lo confirman.

Hacker News

"Tried Sonnet 5.5 but worse than OPUS for thinking for sure, less error/inconsistency check. I used Opus 5.5 med vs. Sonnet 5.5 High on hermes with the same agent.md, and soul.md"

Traducido a soporte, es el cliente empresarial enfadado con una disputa de facturación y tres tickets previos. Ese ticket no se lo daría a Sonnet 5.5 sin supervisión. El restablecimiento de contraseña, la consulta del estado de un pedido o la pregunta "¿cómo exporto mis datos" se las daría todo el día.

Se detiene a hacer preguntas

Hay un desarrollador que ejecuta un benchmark adversarial construido sobre un lenguaje de programación esotérico. En él, Sonnet 5.5 obtuvo 7,4 % frente al 17,8 % de Sonnet 5, y su explicación fue que "is more reluctant to keep going to get an answer, instead it returns to ask the user questions whether to keep going." Base44, en cambio, dijo que "rarely stopped mid-build to ask the user a question."

Mi lectura es que en trabajo interactivo, detenerse a comprobar suele ser lo que quieres de todos modos. En un pipeline desatendido es distinto: un modelo que se detiene a preguntar puede bloquear un trabajo toda la noche. Así que pruébalo en tu propio bucle de agente antes de confiar en él sin supervisión.

Salvaguardas de ciberseguridad y cinco cambios incompatibles

Sonnet 5.5 es el primer Sonnet que se lanza con salvaguardas de ciberseguridad como las de Opus 5.5, por lo que "higher-risk cybersecurity tasks will visibly fall back to Sonnet 5." La corrección rutinaria de bugs no se ve afectada. Aun así, el mayor subhilo de Hacker News fue de gente que hace trabajo de seguridad autorizado y que fue marcada de todos modos.

La guía de migración enumera cinco cambios incompatibles, cada uno de los cuales ahora devuelve un error 400:

CambioQué se rompeSolución
thinking: disabledSolicitudes con el pensamiento totalmente apagadoUsar el nuevo ajuste between_tools
tool_choice forzado (any o tool)Bots que fuerzan una herramienta de clasificaciónDejar que el modelo elija y luego validar
Historial editado antes de un bloque de pensamientoApps que reescriben turnos pasadosMantener el historial solo en modo append
computer_20251124La antigua herramienta de uso del ordenador en la API y Google CloudUsar computer_toolset_20260801
Algunos emparejamientos de la herramienta advisorUn advisor Sonnet 5 u Opus 4.8 con un ejecutor Sonnet 5.5Emparejarlo con Opus 5.5 o Sonnet 5.5

Para los equipos de soporte, la trampa es el tool_choice forzado. Muchas integraciones de helpdesk con IA fuerzan una herramienta de "clasificar este ticket" en cada solicitud para el triaje de tickets, así que si cambias el ID del modelo sin arreglar eso, cada ticket da error. Hay otro más discreto: el texto entre llamadas a herramientas ahora llega dentro de bloques de pensamiento, lo que significa que un widget de chat que transmite "Revisando tu pedido..." puede quedarse en silencio. Por qué ese silencio importa a los clientes se explica en mi guía sobre traspasos de agentes de IA.

Lo que dicen los desarrolladores

La recepción el día del lanzamiento fue mixta, pero de una forma útil. Nadie discute los benchmarks; el debate es más sobre dónde encaja Sonnet 5.5 junto a Opus.

Hacker News

"It appears, at least from a quick look, to be noticeably faster than Opus. If true, and you don't need xhigh/max reasoning for your use case (like a well-defined set of code changes), Sonnet might get the job done much more quickly."

Los escépticos se centran en el precio, en especial en que las lecturas de caché cuestan los mismos 0,20 $ que en Opus 5.5:

Hacker News

"I feel like sonnet is priced too close to opus right now. If Sonnet 5.5 were half its current price it would make sense to use."

El caso de uso al que la gente vuelve una y otra vez es Sonnet como implementador rápido, bajo un planificador Opus:

Reddit

"Firmly places itself as a solid subagent for opus, great work from anthropic, for once I'm interested in what haiku turns out as."

Otro comentarista describió su propio reparto como "80% Sonnet 5.5, Opus 5.5 to finish the last 20%." El patrón encaja bastante bien con los subagentes de Claude Code, y es la configuración que copiaría para mí.

Flujo dibujado a mano de tres tarjetas: Opus 5.5 planifica el trabajo, luego una tarjeta destacada de Sonnet 5.5 en Low o Medium hace cerca del 80 % de la construcción en tres subtareas paralelas, y luego Opus 5.5 pule el último 20 %
Flujo dibujado a mano de tres tarjetas: Opus 5.5 planifica el trabajo, luego una tarjeta destacada de Sonnet 5.5 en Low o Medium hace cerca del 80 % de la construcción en tres subtareas paralelas, y luego Opus 5.5 pule el último 20 %

Precios de Claude Sonnet 5.5 en una tabla

Las tarifas, por millón de tokens, vienen de la documentación de precios de Anthropic:

Precio por 1M de tokensSonnet 5.5Sonnet 5Opus 5.5Haiku 4.5
Entrada$2$2$4$1
Salida$10$10$20$5
Escritura de caché de 5 minutos$2.50$2.50$5$1.25
Lectura de caché$0.20$0.20$0.20$0.10
Batch entrada / salida$1 / $5$1 / $5$2 / $10$0.50 / $2.50
Ventana de contexto1M1M1M200K

Los tokens de pensamiento se facturan como salida, y por eso el ajuste de esfuerzo importa tanto. Una respuesta de soporte en Medium puede pensar unos cientos de tokens, mientras que la misma respuesta en Max puede pensar decenas de miles, todos a 10 $ por millón. La línea del modelo rara vez es la parte más grande del coste de un agente de soporte con IA, pero el dial de esfuerzo es la forma más rápida de convertirla en ello.

El acceso para consumidores es la parte más sencilla. Anthropic dice que cualquiera puede chatear con Sonnet 5.5 en Claude.ai, y los planes de pago están en mi guía de precios de Claude Pro. Desde el primer día también está en Amazon Bedrock y Google Cloud, además de Microsoft Foundry. Si estás comparando proveedores, empieza con la comparación a tres bandas de APIs. Para el cara a cara con OpenAI, lee el análisis de GPT-6 Sol vs Opus 5.5.

Quién debería cambiar y quién esperar

Así tomaría yo la decisión, según lo que ejecutes hoy:

Ejecutas...Mi decisiónAjuste de esfuerzo
Sonnet 5 en producciónCambia esta semana, tras las correcciones de migraciónMedium
Opus 5.5 para programación cotidianaPasa las tareas rutinarias a sub-agentes Sonnet 5.5Low o Medium
Opus 5.5 para planificación abiertaQuédate en Opusn/a
Un bot de soporte con llamadas a herramientas forzadasEspera hasta haber arreglado tool_choiceMedium
Flujos de seguridad o pentestingEspera y solicita el Cyber Verification Programn/a
Etiquetado y enrutamiento de alto volumenQuédate en Haiku 4.5 hasta que salga Haiku 5.5n/a

Anthropic dice que Claude Haiku 5.5 se unirá a la familia "in the coming weeks", así que si tu mayor preocupación es el coste por ticket, vale la pena esperarlo. Para una visión más amplia de opciones, mi resumen de alternativas de Claude para atención al cliente cubre opciones específicas de soporte. Para cambios de modelo en general, consulta la lista de alternativas a Sonnet.

Un modelo más inteligente no arregla una base de conocimiento equivocada

Hay algo que una reseña de modelo no puede mostrarte, y es que la mayoría de los fallos de bots de soporte que he visto no tienen nada que ver con el modelo. Un equipo B2B de telemática de vehículos con unos 200 tickets de Zendesk al mes descubrió que su bot decía a los clientes que soportaba marcas de coches que no estaban en su base de datos. El modelo no estaba alucinando, sin embargo. Su base de conocimiento decía que soportaban "todos los modelos", y el bot simplemente lo creyó. Pasar de Sonnet 5 a Sonnet 5.5 habría dado la misma respuesta equivocada, solo que un 30 % más rápido.

Por eso nunca juzgo un modelo para soporte solo con benchmarks. En eesel cada despliegue se simula contra tickets históricos antes de que el compañero hable con un cliente, porque ahí es donde se detectan los problemas de conocimiento que un modelo mejor no puede arreglar.

Prueba eesel con modelos de clase Claude en tu cola

Si quieres la velocidad de Sonnet 5.5 en tus tickets sin encargarte tú de la migración, eesel es el atajo. Su compañero de helpdesk con IA se une al helpdesk que ya tienes, como Zendesk, aprende de tus tickets anteriores y tu centro de ayuda, y luego redacta o envía respuestas con un modelo de frontera debajo. Todo el ajuste de esfuerzo y los cambios incompatibles de esta reseña pasan a ser trabajo de eesel en lugar del tuyo.

La vista de actividad del compañero de helpdesk con IA de eesel en Zendesk, que lista conversaciones web recientes con su estado pendiente y resuelto y números de ticket vinculados
La vista de actividad del compañero de helpdesk con IA de eesel en Zendesk, que lista conversaciones web recientes con su estado pendiente y resuelto y números de ticket vinculados

Si te gusta trabajar desde una terminal, la CLI de eesel opera el mismo compañero y espacio de trabajo que el panel. Puedes automatizarla con scripts o dejar que la maneje un agente de código como Claude Code, que es básicamente el mismo patrón de "Opus planifica, Sonnet construye" de antes, aplicado a tu configuración de soporte. Mi entrada sobre la CLI de agentes de IA profundiza más, y la de servidores MCP cubre el lado de los conectores.

El plan gratuito incluye 100 créditos y no pide tarjeta, y los planes de pago empiezan en 299 $ por 500 créditos. Prueba eesel con una parte de tus tickets reales y comprueba si el modelo más rápido se traduce de verdad en respuestas más rápidas.

¿Vale la pena Claude Sonnet 5.5?

Sí, con una regla añadida. En esfuerzo Low o Medium, Claude Sonnet 5.5 te da programación y trabajo de conocimiento casi al nivel de Opus a la mitad del precio por token, y es un 30 %+ más rápido con muchos menos tokens. Eso lo convierte en el nuevo valor por defecto para trabajo bien acotado y sub-agentes, y también para las respuestas de soporte cotidianas.

En Max cuesta más que Opus y a veces falla igualmente, así que no lo uses ahí. Conserva Opus 5.5 para las decisiones difíciles y abiertas y arregla tus llamadas a herramientas forzadas antes de migrar. Después, deja que el dial de esfuerzo decida tu factura, no el nombre del modelo.

Preguntas frecuentes

¿Es bueno Claude Sonnet 5.5?
Sí, con el nivel de esfuerzo adecuado. Mi reseña de Claude Sonnet 5.5 encontró que queda a pocos puntos de Opus 5.5 en la mayoría de los benchmarks de lanzamiento y lo supera en Terminal-Bench 4.0 (70,6 % frente a 66,4 %). El inconveniente es el esfuerzo Max, donde puede costar más por tarea que Opus. El resumen de Sonnet 5.5 cubre el lanzamiento completo.
¿Es Claude Sonnet 5.5 mejor que Sonnet 5?
Claramente. Terminal-Bench 4.0 salta de 10,3 % a 70,6 %, GDPval-AA de 1449 a 1844, y Anthropic dice que funciona más de un 30 % más rápido al mismo precio de 2 $/10 $. Mi reseña de Sonnet 5 tiene la referencia si quieres comparar.
¿Vale la pena Claude Sonnet 5.5 frente a Opus 5.5?
En esfuerzo Low o Medium, sí, porque cuesta la mitad por token y Anthropic dice que complementa mejor a Opus en ajustes bajos. Con High o más, el coste por tarea converge y Opus 5.5 suele ser la mejor compra. La guía de precios de Opus 5.5 tiene su tarifa.
¿Cuánto cuesta Claude Sonnet 5.5?
Claude Sonnet 5.5 cuesta 2 $ por millón de tokens de entrada y 10 $ por millón de tokens de salida, con lecturas de caché a 0,20 $ y Batch a 1 $/5 $. Coincide con los precios de Sonnet 5. La guía de precios de la API de Anthropic tiene la tabla completa.
¿Qué nivel de esfuerzo debería usar con Claude Sonnet 5.5?
Empieza en Medium, el valor por defecto en las apps de Claude y en Claude Code, y sube solo cuando una tarea falle. La API usa High por defecto. Evita Max para cualquier cosa abierta, ya que puede gastar los 128k completos de presupuesto de pensamiento sin terminar. Consulta la guía de selección de modelo para fijar los ajustes.
¿Es Claude Sonnet 5.5 bueno para atención al cliente?
Parece un motor sólido para las respuestas del día a día. Zendesk lo probó con cientos de casos reales de soporte y reportó menos decisiones erróneas y tickets procesados un 20 % más rápido. Sigue necesitando apoyarse en tu propio centro de ayuda y en tus tickets anteriores, que es lo que aporta un agente de helpdesk con IA como eesel.
¿Cuáles son las desventajas de Claude Sonnet 5.5?
Cinco cambios en la API ahora devuelven errores, entre ellos la elección forzada de herramienta y el thinking en disabled. Las tareas de ciberseguridad de mayor riesgo recurren a Sonnet 5, y el autor de un benchmark encontró que se detiene a preguntar al usuario con más frecuencia. La guía de la API de helpdesk con IA explica por qué las herramientas forzadas importan en los bots de soporte.
¿Cuáles son las alternativas a Claude Sonnet 5.5?
Dentro de la gama de Anthropic, Opus 5.5 es el paso hacia arriba y Haiku 4.5 el paso más barato hacia abajo. Fuera de ella, GPT-6 Sol es el principal rival en la tabla de lanzamiento. El resumen de alternativas a Sonnet cubre el resto del mercado.

Share this article

Kira

Article by

Kira

Kira is a writer at eesel AI with a Computer Science background and over a year of hands-on experience evaluating AI-powered customer service tools. She focuses on breaking down how helpdesk platforms and AI agents actually work so that support teams can make better buying decisions.

Related Posts

All posts →
Ilustración dibujada a mano de un agente de soporte frente a un portátil que despeja rápidamente una pila de tickets, para una publicación sobre Claude Sonnet 5.5
Trending

Claude Sonnet 5.5: mismo precio, menos tokens y 5 cambios que rompen la compatibilidad

Claude Sonnet 5.5 mantiene el precio de Sonnet 5 (2 $/10 $), pero hace el mismo trabajo con muchos menos tokens. Qué cambió, qué se rompe y qué significa para el soporte.

Riellvriany IndriawanRiellvriany IndriawanSep 29, 2026
Una ilustración que compara Claude Mythos 5.1 y Fable 5.1 como el mismo modelo subyacente detrás de distintas capas de seguridad
Trending

Reseña de Claude Mythos 5.1: ¿vale la pena perseguir el modelo frontera bloqueado de Anthropic?

Una reseña práctica de Claude Mythos 5.1: qué es, cómo se compara con Fable 5.1, el precio real de la lectura de caché, quién puede acceder realmente y qué usaría yo en su lugar.

Kurnia KharismaKurnia KharismaSep 8, 2026
Illustration comparing a heavyweight reasoning model against a fast balanced model on cost and capability
Trending

Claude Opus 5 vs Sonnet 5: ¿cuál deberías usar?

Claude Opus 5 cuesta 1.7x lo que Sonnet 5 por token y aun así termina algunos trabajos más barato. Aquí va el cara a cara sobre precio, benchmarks y coste real por tarea.

Rama AdiRama AdiJul 27, 2026
Illustration of a developer at a laptop watching an agentic coding loop run through code, checks and a bot
Trending

Reseña de Claude Opus 5: programación casi de nivel frontera a mitad de precio

Una reseña práctica de Claude Opus 5: lo que realmente dicen los benchmarks, la tasa de alucinaciones que subió, y si tiene sentido en una cola de soporte en producción.

KiraKiraJul 27, 2026
Ilustración de Claude Sonnet 5 con el logotipo de Anthropic y un flujo de trabajo de soporte
Guides

Claude Sonnet 5: qué significa para el soporte al cliente

Claude Sonnet 5 ofrece una calidad de codificación y agéntica cercana a Opus a precios de gama media. Esto es lo que el modelo realmente cambia para los equipos de soporte, y lo que no.

Rama AdiRama AdiJul 1, 2026
Ilustración de precios por token y pilas de costos para el modelo Claude Mythos 5.1
Trending

Precios de Claude Mythos 5.1: cada tarifa, el recorte de la lectura de caché y quién puede usarlo realmente

Un desglose completo de los precios de Claude Mythos 5.1: tarifas base, batch, escrituras de caché y la lectura de caché a 0,25 $ que es la verdadera noticia, además de por qué Mythos cuesta lo mismo que Fable 5.1.

Kurnia KharismaKurnia KharismaSep 8, 2026
Una ilustración de la puerta de una bóveda siendo abierta por una pequeña lista aprobada de investigadores, que representa el acceso solo por invitación a Claude Mythos 5.1
Trending

Claude Mythos 5.1: qué es, quién tiene acceso y qué usar en su lugar

Claude Mythos 5.1 se lanzó el 1 de septiembre de 2026, y casi nadie puede usarlo. Aquí está la ficha técnica real, los dos programas de acceso y el modelo que deberías usar en la práctica.

KiraKiraSep 2, 2026
Una ilustración de una persona seleccionando uno de cinco reguladores de esfuerzo de razonamiento en una barra de control al estilo Claude Opus 5
Trending

Claude Opus 5: qué es y cómo usarlo de verdad

Claude Opus 5 no es un modelo, son cinco. Una guía sencilla sobre las especificaciones, el regulador de esfuerzo que decide tu factura, y los dos cambios de API que rompen código antiguo.

Kurnia KharismaKurnia KharismaAug 5, 2026
Una ilustración de una persona seleccionando uno de los cinco diales de esfuerzo de razonamiento en una tira de control estilo Claude Opus 5
Trending

Claude Opus 5: qué es y cómo usarlo de verdad

Claude Opus 5 no es un modelo, son cinco. Una guía práctica sobre las especificaciones, el dial de esfuerzo que decide tu factura y los dos cambios de API que rompen el código antiguo.

Kurnia KharismaKurnia KharismaAug 5, 2026

Listo para contratar tu companero de IA?

Configuracion en minutos. Sin tarjeta de credito requerida.

Comienza gratis