
The comparison everyone wants does not exist yet
Empecemos por la parte incómoda, porque cualquier otro artículo sobre este enfrentamiento simplemente la pasa por alto.
Una comparación de modelos necesita dos conjuntos de números. Anthropic publicó los suyos: una ficha de sistema, una tabla de precios, y todo un muro de socios de lanzamiento con nombre propio dando cifras oficiales. Alibaba publicó dos posts en X y un endpoint de pago en funcionamiento. Esa es toda la base de evidencia para un modelo al que llaman el segundo mejor del mundo.

Para poner en contexto cuánto se aleja esto del propio listón de Alibaba: el flagship anterior, Qwen3.7-Max, se lanzó en mayo de 2026 con números reales, un 80,4% en SWE-bench Verified, y el puesto más alto entre los modelos chinos en el índice de Artificial Analysis en ese momento. Qwen3.8-Max llegó con la confianza y sin ninguno de los comprobantes.
Así que trata lo que sigue como una comparación de dos productos, y no de dos inteligencias. Es la única comparación que la evidencia realmente respalda.
What Qwen3.8-Max actually is
Qwen es la familia de modelos de Alibaba Cloud, y "Max" es la línea flagship propietaria, por encima de los niveles más baratos Plus y Turbo. Qwen3.8-Max se presentó en vista previa el 19 de julio de 2026.
Las especificaciones que declara Alibaba:
- 2,4 billones de parámetros totales en un diseño disperso de Mixture-of-Experts, según Qwen en X.
- El primer Qwen multimodal por encima de 1T de parámetros, que acepta texto, imágenes, vídeo y documentos, según el investigador principal Shuai Bai.
- Una ventana de contexto de 1 millón de tokens, heredada de Qwen3.7-Max.
- Orientado a codificación y trabajo agéntico, que es donde Alibaba dice que supera a su predecesor.
El número de parámetros activos, la relación de dispersión y la licencia faltaban por completo. Un modelo denso de 2,4T sería demasiado caro de servir, así que el enrutado MoE es lo que hace esa cifra viable, y es exactamente la cifra que nadie publicó.
"Qwen3.8-Max Preview is now available for early access! This is our first trillion-parameter multimodal model."
What Claude Fable 5 actually is
Anthropic presenta Fable 5 como su modelo generalmente disponible más capaz, construido para "trabajo ambicioso, de larga duración y asíncrono". El enfoque es inusualmente estrecho para un flagship. El propio resumen de modelos de Anthropic recomienda empezar con Claude Opus 5, y subir a Fable 5 solo para las cargas de trabajo que necesitan la máxima capacidad disponible.
Hay varias cosas que lo convierten en un animal genuinamente distinto respecto a un lanzamiento de modelo normal.
El razonamiento está siempre activo. Fable 5 no acepta el parámetro heredado de pensamiento extendido, y no tiene ningún interruptor de apagado publicado. La profundidad se controla mediante el nivel de esfuerzo.
Redirige su propio tráfico. Fable 5 viene con salvaguardas para ciberseguridad y biología, y las consultas marcadas se enrutan automáticamente a modelos menos capaces. Las consultas de ciberseguridad bajan a Opus 4.8, las de biología a Opus 5. Una respuesta de Opus es literalmente lo que devuelve una solicitud bloqueada de Fable, algo bastante extraño de descubrir a mitad de un flujo de trabajo.
Usarlo requiere una retención de datos de 30 días para el monitoreo de seguridad. Para un comprador regulado, eso es una conversación de compras y no una simple casilla que marcar.
Las cifras de los socios de lanzamiento son la evidencia más sólida de toda esta comparación, y merece la pena leerlas como afirmaciones de coste más que de inteligencia. Un socio informa de que Fable 5 supera a Opus 4.8 en una suite de hojas de cálculo cotidiana en todos los niveles de esfuerzo, mientras termina las ejecuciones un 25-30% más rápido. Otro afirma haber alcanzado resultados de física de vanguardia usando un tercio de los tokens de razonamiento.
Head to head on what is actually published
Aquí está cada dimensión donde ambas partes han dicho algo concreto. Las celdas en blanco están vacías porque el proveedor no lo publicó, no porque yo no lo haya encontrado.
| Qwen3.8-Max | Claude Fable 5 | |
|---|---|---|
| Vendor | Alibaba Cloud | Anthropic |
| Status | Vista previa (Qwen3.8-Max-Preview) | Disponibilidad general |
| Launched | 19 de julio de 2026 | 9 de junio de 2026 |
| Model ID | no publicado | claude-fable-5 |
| Architecture | Mixture-of-Experts disperso de 2,4T | no publicado |
| Multimodal input | Texto, imágenes, vídeo, documentos | Texto, imágenes, diagramas, gráficos, PDF |
| Context window | 1M tokens | 1M tokens |
| Max output | no publicado | 128k tokens |
| Input price | sin tarifa por token publicada | 10 $ / MTok |
| Output price | sin tarifa por token publicada | 50 $ / MTok |
| How you buy it | Suscripción Token Plan, Qoder, QoderWork | Claude API, Bedrock, Google Cloud, Microsoft Foundry |
| Prompt caching discount | no publicado | 90% en tokens de entrada |
| Benchmark table | ninguna en la vista previa | benchmarks de socios, sin tabla numérica pública |
| Model / system card | ninguna | ficha de sistema publicada |
| Open weights | prometido "pronto", sin fecha ni licencia | no |
| API protocols | compatible con OpenAI y Anthropic | Anthropic |
| Data retention | no publicado | 30 días, obligatorio |
| Documented outage | n/a (vista previa) | 12 de junio al 1 de julio de 2026 |
| Knowledge cutoff | no publicado | enero de 2026 |
Dos de las filas merecen una segunda mirada.
La fila de API protocol es la ventaja oculta. El endpoint del Token Plan de Alibaba habla tanto el protocolo de OpenAI como el de Anthropic, así que Claude Code, Cursor y Cline funcionan con Qwen3.8-Max en cuanto tienes una clave. Probarlo es cosa de cinco minutos, y esa accesibilidad hace buena parte del trabajo detrás del revuelo.
La fila de knowledge cutoff es la rareza silenciosa de Fable 5. Enero de 2026 es cuatro meses más antiguo que el corte de mayo de 2026 de Opus 5, a pesar de que Fable es el modelo más nuevo y más caro. Así que si tu trabajo depende de hechos recientes, el modelo caro sabe menos.
Price: two sheets that do not line up
Aquí es donde la comparación se rompe por completo, en lugar de simplemente volverse difusa.

Anthropic vende tokens. Fable 5 cuesta 10$ de entrada y 50$ de salida por millón, exactamente el doble de Claude Opus 5 en ambas líneas, con el descuento del 90% por caché de prompts todavía aplicable, y la inferencia exclusiva de EE. UU. disponible a 1,1x.
Alibaba vende una suscripción en su lugar. Durante la vista previa, Qwen3.8-Max funciona al 10% del precio estándar a través del Token Plan, con niveles Personal a aproximadamente 6$, 20$ y 70$ al mes para Lite, Standard y Pro. Súmale encima el descuento nocturno, un 80% adicional de descuento en el consumo de créditos entre las 22:00 y las 08:00 (UTC+8), y las ejecuciones fuera de horario caen a cerca del 0,2% de la tarifa estándar.
No puedes dividir esas dos cifras entre sí. Una es una tarifa, la otra es una cuota, y el denominador de esa cuota son créditos cuya conversión a tokens nunca se publicó.
También hay una segunda trampa en el modelo de suscripción, y no es hipotética. En la generación anterior, los usuarios de Qwen informaron de que los créditos se agotaban mucho más rápido de lo esperado, y los modelos Qwen sí tienden a generar más tokens de salida por tarea que sus competidores. Lo cual infla en silencio el coste real incluso cuando la etiqueta de precio parece inmejorable. El descuento de vista previa lo disimula por ahora. Presupuesta para el día en que termine, y lee nuestro desglose de precios de Qwen3.8-Max antes de comprometer ninguna carga de trabajo.
Mientras tanto, las afirmaciones de los socios de Fable 5 van en sentido contrario en el coste total. Menos turnos, y un tercio de los tokens de razonamiento en tareas difíciles, significa que la etiqueta 2x no se traduce en una factura 2x. Es la misma lógica que repasamos en nuestra comparación de Opus 5 vs Sonnet 5, donde el modelo más barato no es automáticamente también el trabajo más barato.
Where each one actually breaks
Pregunta "cuál es mejor" y te encoges de hombros. Pregunta "cuál puedo poner en producción el lunes", y ambos responden que no, por razones completamente distintas.

Qwen3.8-Max es una vista previa. Sin licencia y sin precio por token, tampoco ficha de modelo, además de un endpoint que puede cambiar bajo tus pies. Bien para experimentos, y descalificante para cualquier cosa con un cliente detrás.
Fable 5 tiene un historial público de disponibilidad con un agujero en medio. Anthropic lanzó el 9 de junio, retiró el acceso el 12 de junio, y luego lo restauró el 1 de julio. Diecinueve días, reconocidos por el propio proveedor en su propio sitio. Suma la retención obligatoria de 30 días y la redirección de las salvaguardas, y tienes tres preguntas de compras que responder antes de que un solo ticket lo haga.
Ninguna de las dos cosas es un golpe contra el modelo subyacente. Ambas son razones por las que la elección importa menos que la arquitectura que construyes a su alrededor.
So which one should you actually test?
La vista previa es barata y el flagship es rápido, lo que convierte "debería cambiar" en la pregunta equivocada. Primero averigua qué es realmente lo que estás probando.
¿Qwen3.8-Max o Claude Fable 5?
Elige el trabajo que realmente tienes.
What this actually means if you are buying for support
Ahora viene la parte que realmente me importa, porque construir agentes de IA para colas de soporte es mi trabajo del día a día.
Cada pocas semanas, un lanzamiento como este hace que la gente piense que el modelo es el cuello de botella. No lo es, y esa brecha es precisamente el lugar donde la mayoría de los proyectos de IA para soporte mueren en silencio. Tanto Qwen3.8-Max como Fable 5 te dan razonamiento en bruto. Ninguno conoce tu política de reembolsos, ni los casos límite de tu producto, ni el hecho de que el ticket #4021 es un VIP que ya ha escrito dos veces. Ninguno tiene una barrera de seguridad que le impida inventar una respuesta con confianza, y ninguno se conecta al helpdesk donde realmente ocurre el trabajo.
Hemos pasado años poniendo IA en colas de soporte reales, y la lección que quedó grabada es que una respuesta segura pero equivocada es peor que ninguna respuesta. El bot de un cliente confirmó alegremente que era compatible con modelos de producto que no estaban en su base de datos, porque el centro de ayuda decía "compatible con todos los modelos". Un número de parámetros mayor hace ese fallo más probable, no menos, porque el modelo suena aún más seguro de sí mismo. Un responsable de soporte lo expresó mejor de lo que yo podría:
"The AI will never be able to answer 100% of the questions, but if it tries and just answers wrong, I cannot go check all my 7,000 tickets to see if it made a good answer. I need an AI that only handles the tickets it's confident about, and leaves the rest alone."
a DTC brand CX lead handling 7,000 tickets a month
Eso es una declaración sobre arquitectura, no sobre elección de modelo. Es la razón por la que eesel AI simula sobre tus tickets históricos antes de que nada salga a producción, así ves la tasa de resolución y las respuestas exactas sobre conversaciones pasadas reales, en lugar de descubrirlo a través de un cliente. También es la razón por la que las respuestas se enrutan según la confianza: la duda significa borrador o escalado, y nunca adivinar. Aplicando esto, Gridwise alcanzó un 73% de resolución de nivel 1 en su primer mes.
El punto más amplio es el que vale la pena sacar de todo este enfrentamiento. Dos laboratorios acaban de mover el techo de tamaño en apenas dos semanas, Kimi K3 con 2,8T y Qwen3.8-Max con 2,4T, y luego Anthropic lanzó un modelo que funciona sin supervisión durante días. La capa de modelo mejora y se abarata más rápido de lo que cualquier ciclo de compras puede seguir. Así que construye de forma que puedas cambiar el motor sin tener que rehacer todo lo que lo rodea, y cada una de esas ganancias caerá en tu regazo gratis.
Try eesel AI
Si llegaste hasta aquí intentando decidir qué modelo apuntar a tu cola de soporte, la respuesta honesta es que esa elección importa mucho menos que la capa que se sitúa por encima. Esa capa es lo que es eesel AI.

Se conecta con Zendesk, Freshdesk, Slack y más de 100 herramientas más, aprende de tu centro de ayuda y tus tickets anteriores, y empieza a redactar en minutos. El diferenciador es la rampa de confianza: simula sobre tu historial real de tickets, lee los números, empieza en modo borrador, y pasa a autónomo solo cuando estés satisfecho. Obtienes la inteligencia del modelo de frontera con barreras de seguridad construidas para soporte, y nunca más tendrás que volver a hacer tú mismo esta comparación. Prueba eesel gratis, sin tarjeta de crédito.
Preguntas frecuentes
¿Es Qwen3.8-Max mejor que Claude Fable 5?
¿Cómo se compara el precio de Qwen3.8-Max con el de Claude Fable 5?
¿Cuál es la ventana de contexto de Qwen3.8-Max frente a Claude Fable 5?
¿Qwen3.8-Max es de código abierto y Claude Fable 5 no lo es?
¿Puedo usar Qwen3.8-Max o Claude Fable 5 para atención al cliente?
¿Qué modelo debería elegir si necesito un tiempo de actividad fiable?
¿Cuáles son las mejores alternativas a Qwen3.8-Max?

Article by
Kurnia Kharisma Agung Samiadjie
Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.







