Qwen3.8-Max vs Claude Fable 5: la comparación que nadie puede hacer

Kurnia Kharisma Agung Samiadjie
Escrito por

Kurnia Kharisma Agung Samiadjie

Katelin Teen
Revisado por

Katelin Teen

Última edición August 3, 2026

Verificado por expertos
Ilustración que compara la vista previa de Qwen3.8-Max de Alibaba con Claude Fable 5 de Anthropic

The comparison everyone wants does not exist yet

Empecemos por la parte incómoda, porque cualquier otro artículo sobre este enfrentamiento simplemente la pasa por alto.

Una comparación de modelos necesita dos conjuntos de números. Anthropic publicó los suyos: una ficha de sistema, una tabla de precios, y todo un muro de socios de lanzamiento con nombre propio dando cifras oficiales. Alibaba publicó dos posts en X y un endpoint de pago en funcionamiento. Esa es toda la base de evidencia para un modelo al que llaman el segundo mejor del mundo.

Marcador que compara lo que Alibaba y Anthropic publicaron cada uno en el lanzamiento: Qwen3.8-Max no tiene números de benchmark, ficha de modelo, precio por token ni socios con nombre, mientras que Claude Fable 5 tiene las cuatro cosas
Marcador que compara lo que Alibaba y Anthropic publicaron cada uno en el lanzamiento: Qwen3.8-Max no tiene números de benchmark, ficha de modelo, precio por token ni socios con nombre, mientras que Claude Fable 5 tiene las cuatro cosas

Para poner en contexto cuánto se aleja esto del propio listón de Alibaba: el flagship anterior, Qwen3.7-Max, se lanzó en mayo de 2026 con números reales, un 80,4% en SWE-bench Verified, y el puesto más alto entre los modelos chinos en el índice de Artificial Analysis en ese momento. Qwen3.8-Max llegó con la confianza y sin ninguno de los comprobantes.

Así que trata lo que sigue como una comparación de dos productos, y no de dos inteligencias. Es la única comparación que la evidencia realmente respalda.

What Qwen3.8-Max actually is

Qwen es la familia de modelos de Alibaba Cloud, y "Max" es la línea flagship propietaria, por encima de los niveles más baratos Plus y Turbo. Qwen3.8-Max se presentó en vista previa el 19 de julio de 2026.

Las especificaciones que declara Alibaba:

  • 2,4 billones de parámetros totales en un diseño disperso de Mixture-of-Experts, según Qwen en X.
  • El primer Qwen multimodal por encima de 1T de parámetros, que acepta texto, imágenes, vídeo y documentos, según el investigador principal Shuai Bai.
  • Una ventana de contexto de 1 millón de tokens, heredada de Qwen3.7-Max.
  • Orientado a codificación y trabajo agéntico, que es donde Alibaba dice que supera a su predecesor.

El número de parámetros activos, la relación de dispersión y la licencia faltaban por completo. Un modelo denso de 2,4T sería demasiado caro de servir, así que el enrutado MoE es lo que hace esa cifra viable, y es exactamente la cifra que nadie publicó.

"Qwen3.8-Max Preview is now available for early access! This is our first trillion-parameter multimodal model."

What Claude Fable 5 actually is

Anthropic presenta Fable 5 como su modelo generalmente disponible más capaz, construido para "trabajo ambicioso, de larga duración y asíncrono". El enfoque es inusualmente estrecho para un flagship. El propio resumen de modelos de Anthropic recomienda empezar con Claude Opus 5, y subir a Fable 5 solo para las cargas de trabajo que necesitan la máxima capacidad disponible.

Hay varias cosas que lo convierten en un animal genuinamente distinto respecto a un lanzamiento de modelo normal.

El razonamiento está siempre activo. Fable 5 no acepta el parámetro heredado de pensamiento extendido, y no tiene ningún interruptor de apagado publicado. La profundidad se controla mediante el nivel de esfuerzo.

Redirige su propio tráfico. Fable 5 viene con salvaguardas para ciberseguridad y biología, y las consultas marcadas se enrutan automáticamente a modelos menos capaces. Las consultas de ciberseguridad bajan a Opus 4.8, las de biología a Opus 5. Una respuesta de Opus es literalmente lo que devuelve una solicitud bloqueada de Fable, algo bastante extraño de descubrir a mitad de un flujo de trabajo.

Usarlo requiere una retención de datos de 30 días para el monitoreo de seguridad. Para un comprador regulado, eso es una conversación de compras y no una simple casilla que marcar.

Las cifras de los socios de lanzamiento son la evidencia más sólida de toda esta comparación, y merece la pena leerlas como afirmaciones de coste más que de inteligencia. Un socio informa de que Fable 5 supera a Opus 4.8 en una suite de hojas de cálculo cotidiana en todos los niveles de esfuerzo, mientras termina las ejecuciones un 25-30% más rápido. Otro afirma haber alcanzado resultados de física de vanguardia usando un tercio de los tokens de razonamiento.

Head to head on what is actually published

Aquí está cada dimensión donde ambas partes han dicho algo concreto. Las celdas en blanco están vacías porque el proveedor no lo publicó, no porque yo no lo haya encontrado.

Qwen3.8-MaxClaude Fable 5
VendorAlibaba CloudAnthropic
StatusVista previa (Qwen3.8-Max-Preview)Disponibilidad general
Launched19 de julio de 20269 de junio de 2026
Model IDno publicadoclaude-fable-5
ArchitectureMixture-of-Experts disperso de 2,4Tno publicado
Multimodal inputTexto, imágenes, vídeo, documentosTexto, imágenes, diagramas, gráficos, PDF
Context window1M tokens1M tokens
Max outputno publicado128k tokens
Input pricesin tarifa por token publicada10 $ / MTok
Output pricesin tarifa por token publicada50 $ / MTok
How you buy itSuscripción Token Plan, Qoder, QoderWorkClaude API, Bedrock, Google Cloud, Microsoft Foundry
Prompt caching discountno publicado90% en tokens de entrada
Benchmark tableninguna en la vista previabenchmarks de socios, sin tabla numérica pública
Model / system cardningunaficha de sistema publicada
Open weightsprometido "pronto", sin fecha ni licenciano
API protocolscompatible con OpenAI y AnthropicAnthropic
Data retentionno publicado30 días, obligatorio
Documented outagen/a (vista previa)12 de junio al 1 de julio de 2026
Knowledge cutoffno publicadoenero de 2026

Dos de las filas merecen una segunda mirada.

La fila de API protocol es la ventaja oculta. El endpoint del Token Plan de Alibaba habla tanto el protocolo de OpenAI como el de Anthropic, así que Claude Code, Cursor y Cline funcionan con Qwen3.8-Max en cuanto tienes una clave. Probarlo es cosa de cinco minutos, y esa accesibilidad hace buena parte del trabajo detrás del revuelo.

La fila de knowledge cutoff es la rareza silenciosa de Fable 5. Enero de 2026 es cuatro meses más antiguo que el corte de mayo de 2026 de Opus 5, a pesar de que Fable es el modelo más nuevo y más caro. Así que si tu trabajo depende de hechos recientes, el modelo caro sabe menos.

Price: two sheets that do not line up

Aquí es donde la comparación se rompe por completo, en lugar de simplemente volverse difusa.

Eje de precios que muestra a Claude Sonnet 5 en 3$/15$, Opus 5 en 5$/25$ y Fable 5 en 10$/50$ por millón de tokens, con Qwen3.8-Max fuera del eje en un recuadro punteado porque no se publicó ninguna tarifa por token
Eje de precios que muestra a Claude Sonnet 5 en 3$/15$, Opus 5 en 5$/25$ y Fable 5 en 10$/50$ por millón de tokens, con Qwen3.8-Max fuera del eje en un recuadro punteado porque no se publicó ninguna tarifa por token

Anthropic vende tokens. Fable 5 cuesta 10$ de entrada y 50$ de salida por millón, exactamente el doble de Claude Opus 5 en ambas líneas, con el descuento del 90% por caché de prompts todavía aplicable, y la inferencia exclusiva de EE. UU. disponible a 1,1x.

Alibaba vende una suscripción en su lugar. Durante la vista previa, Qwen3.8-Max funciona al 10% del precio estándar a través del Token Plan, con niveles Personal a aproximadamente 6$, 20$ y 70$ al mes para Lite, Standard y Pro. Súmale encima el descuento nocturno, un 80% adicional de descuento en el consumo de créditos entre las 22:00 y las 08:00 (UTC+8), y las ejecuciones fuera de horario caen a cerca del 0,2% de la tarifa estándar.

No puedes dividir esas dos cifras entre sí. Una es una tarifa, la otra es una cuota, y el denominador de esa cuota son créditos cuya conversión a tokens nunca se publicó.

También hay una segunda trampa en el modelo de suscripción, y no es hipotética. En la generación anterior, los usuarios de Qwen informaron de que los créditos se agotaban mucho más rápido de lo esperado, y los modelos Qwen sí tienden a generar más tokens de salida por tarea que sus competidores. Lo cual infla en silencio el coste real incluso cuando la etiqueta de precio parece inmejorable. El descuento de vista previa lo disimula por ahora. Presupuesta para el día en que termine, y lee nuestro desglose de precios de Qwen3.8-Max antes de comprometer ninguna carga de trabajo.

Mientras tanto, las afirmaciones de los socios de Fable 5 van en sentido contrario en el coste total. Menos turnos, y un tercio de los tokens de razonamiento en tareas difíciles, significa que la etiqueta 2x no se traduce en una factura 2x. Es la misma lógica que repasamos en nuestra comparación de Opus 5 vs Sonnet 5, donde el modelo más barato no es automáticamente también el trabajo más barato.

Where each one actually breaks

Pregunta "cuál es mejor" y te encoges de hombros. Pregunta "cuál puedo poner en producción el lunes", y ambos responden que no, por razones completamente distintas.

Dos caminos que convergen en una puerta cerrada etiquetada como Producción por defecto: Qwen3.8-Max bloqueado por ser un endpoint de vista previa, sin licencia y sin precio por token; Claude Fable 5 bloqueado por una interrupción de 19 días, una retención obligatoria de 30 días y las redirecciones de las salvaguardas
Dos caminos que convergen en una puerta cerrada etiquetada como Producción por defecto: Qwen3.8-Max bloqueado por ser un endpoint de vista previa, sin licencia y sin precio por token; Claude Fable 5 bloqueado por una interrupción de 19 días, una retención obligatoria de 30 días y las redirecciones de las salvaguardas

Qwen3.8-Max es una vista previa. Sin licencia y sin precio por token, tampoco ficha de modelo, además de un endpoint que puede cambiar bajo tus pies. Bien para experimentos, y descalificante para cualquier cosa con un cliente detrás.

Fable 5 tiene un historial público de disponibilidad con un agujero en medio. Anthropic lanzó el 9 de junio, retiró el acceso el 12 de junio, y luego lo restauró el 1 de julio. Diecinueve días, reconocidos por el propio proveedor en su propio sitio. Suma la retención obligatoria de 30 días y la redirección de las salvaguardas, y tienes tres preguntas de compras que responder antes de que un solo ticket lo haga.

Ninguna de las dos cosas es un golpe contra el modelo subyacente. Ambas son razones por las que la elección importa menos que la arquitectura que construyes a su alrededor.

So which one should you actually test?

La vista previa es barata y el flagship es rápido, lo que convierte "debería cambiar" en la pregunta equivocada. Primero averigua qué es realmente lo que estás probando.

¿Qwen3.8-Max o Claude Fable 5?

Elige el trabajo que realmente tienes.

¿Qué intentas hacer?
Qwen3.8-Max. Al 10% del precio estándar, y alrededor del 0,2% por la noche, la vista previa es la forma más barata de tantear un modelo multimodal de 2,4T. El soporte dual de protocolo OpenAI y Anthropic significa que tu herramienta actual se conecta hoy mismo.
Claude Fable 5. Esta es la carga de trabajo para la que realmente se construyó, y la única de los dos con evidencia de socios publicada para trabajo de largo horizonte. Espera que la etiqueta 2x quede parcialmente compensada por menos turnos.
Ninguno, todavía. Qwen3.8-Max es un endpoint de vista previa sin licencia. Fable 5 tiene una interrupción de 19 días en su historial y una retención obligatoria de 30 días. Prototipa con ambos, no te comprometas con ninguno, y mantén el modelo intercambiable.
Es la capa equivocada por completo. Un modelo en bruto no tiene memoria de tus tickets, ni barreras de seguridad, ni conexión con el helpdesk. Lo que necesitas es una capa lista para soporte sobre un modelo de frontera, no el modelo solo. Eso es la siguiente sección.

What this actually means if you are buying for support

Ahora viene la parte que realmente me importa, porque construir agentes de IA para colas de soporte es mi trabajo del día a día.

Cada pocas semanas, un lanzamiento como este hace que la gente piense que el modelo es el cuello de botella. No lo es, y esa brecha es precisamente el lugar donde la mayoría de los proyectos de IA para soporte mueren en silencio. Tanto Qwen3.8-Max como Fable 5 te dan razonamiento en bruto. Ninguno conoce tu política de reembolsos, ni los casos límite de tu producto, ni el hecho de que el ticket #4021 es un VIP que ya ha escrito dos veces. Ninguno tiene una barrera de seguridad que le impida inventar una respuesta con confianza, y ninguno se conecta al helpdesk donde realmente ocurre el trabajo.

Hemos pasado años poniendo IA en colas de soporte reales, y la lección que quedó grabada es que una respuesta segura pero equivocada es peor que ninguna respuesta. El bot de un cliente confirmó alegremente que era compatible con modelos de producto que no estaban en su base de datos, porque el centro de ayuda decía "compatible con todos los modelos". Un número de parámetros mayor hace ese fallo más probable, no menos, porque el modelo suena aún más seguro de sí mismo. Un responsable de soporte lo expresó mejor de lo que yo podría:

"The AI will never be able to answer 100% of the questions, but if it tries and just answers wrong, I cannot go check all my 7,000 tickets to see if it made a good answer. I need an AI that only handles the tickets it's confident about, and leaves the rest alone."

a DTC brand CX lead handling 7,000 tickets a month

Eso es una declaración sobre arquitectura, no sobre elección de modelo. Es la razón por la que eesel AI simula sobre tus tickets históricos antes de que nada salga a producción, así ves la tasa de resolución y las respuestas exactas sobre conversaciones pasadas reales, en lugar de descubrirlo a través de un cliente. También es la razón por la que las respuestas se enrutan según la confianza: la duda significa borrador o escalado, y nunca adivinar. Aplicando esto, Gridwise alcanzó un 73% de resolución de nivel 1 en su primer mes.

El punto más amplio es el que vale la pena sacar de todo este enfrentamiento. Dos laboratorios acaban de mover el techo de tamaño en apenas dos semanas, Kimi K3 con 2,8T y Qwen3.8-Max con 2,4T, y luego Anthropic lanzó un modelo que funciona sin supervisión durante días. La capa de modelo mejora y se abarata más rápido de lo que cualquier ciclo de compras puede seguir. Así que construye de forma que puedas cambiar el motor sin tener que rehacer todo lo que lo rodea, y cada una de esas ganancias caerá en tu regazo gratis.

Try eesel AI

Si llegaste hasta aquí intentando decidir qué modelo apuntar a tu cola de soporte, la respuesta honesta es que esa elección importa mucho menos que la capa que se sitúa por encima. Esa capa es lo que es eesel AI.

El panel de helpdesk de eesel AI, donde un compañero de IA resuelve y redacta tickets de soporte
El panel de helpdesk de eesel AI, donde un compañero de IA resuelve y redacta tickets de soporte

Se conecta con Zendesk, Freshdesk, Slack y más de 100 herramientas más, aprende de tu centro de ayuda y tus tickets anteriores, y empieza a redactar en minutos. El diferenciador es la rampa de confianza: simula sobre tu historial real de tickets, lee los números, empieza en modo borrador, y pasa a autónomo solo cuando estés satisfecho. Obtienes la inteligencia del modelo de frontera con barreras de seguridad construidas para soporte, y nunca más tendrás que volver a hacer tú mismo esta comparación. Prueba eesel gratis, sin tarjeta de crédito.

Preguntas frecuentes

¿Es Qwen3.8-Max mejor que Claude Fable 5?
Todavía nadie puede decirlo, y eso incluye a Alibaba. El post de lanzamiento de Alibaba llamó a Qwen3.8-Max "solo por detrás de Fable 5", pero no publicó ninguna tabla de benchmarks, ninguna ficha de modelo ni ninguna puntuación de un índice independiente, así que la afirmación no está verificada. Anthropic publicó benchmarks de socios y una ficha de sistema para Fable 5. Nuestra reseña de Qwen3.8-Max analiza qué se midió y qué no.
¿Cómo se compara el precio de Qwen3.8-Max con el de Claude Fable 5?
No están en la misma tabla de precios. Claude Fable 5 cuesta 10 dólares por millón de tokens de entrada y 50 dólares por millón de tokens de salida. Qwen3.8-Max no tiene una tarifa API independiente por token durante la vista previa; se vende mediante la suscripción Token Plan de Alibaba al 10% del precio estándar. Consulta nuestra guía de precios de Qwen3.8-Max y nuestro análisis de precios de Claude Opus 5 para el panorama completo.
¿Cuál es la ventana de contexto de Qwen3.8-Max frente a Claude Fable 5?
Ambos tienen una ventana de contexto de 1 millón de tokens. Fable 5 también publica un máximo de salida de 128k tokens. Qwen3.8-Max hereda su ventana de 1M de Qwen3.7-Max, y no se publicó ninguna cifra de salida máxima en la vista previa. Para saber cómo se comportan las ventanas grandes en el trabajo de soporte real, consulta nuestra guía sobre RAG frente a contexto largo.
¿Qwen3.8-Max es de código abierto y Claude Fable 5 no lo es?
Ninguno de los dos publica pesos hoy. Alibaba dice que Qwen3.8 pasará a ser de peso abierto "pronto", sin fecha ni licencia adjunta, y Anthropic directamente no publica pesos. Si necesitas pesos abiertos, mira nuestro resumen de agentes de IA de código abierto y modelos de lenguaje pequeños.
¿Puedo usar Qwen3.8-Max o Claude Fable 5 para atención al cliente?
Puedes enviar tickets a cualquiera de los dos, pero un modelo en bruto solo es el motor. No tiene memoria de tus tickets anteriores, ni barreras de seguridad, ni conexión con el helpdesk. eesel AI aporta esa capa y se conecta con Zendesk y Freshdesk, así obtienes una IA para atención al cliente en vez de una simple ventana de chat.
¿Qué modelo debería elegir si necesito un tiempo de actividad fiable?
Revisa el historial de disponibilidad, no los benchmarks. Anthropic retiró públicamente el acceso a Claude Fable 5 del 12 de junio al 1 de julio de 2026, y Qwen3.8-Max es un endpoint de vista previa que puede cambiar sin previo aviso. Para cualquier cosa de cara al cliente, nuestra guía de soluciones de IA para atención al cliente explica cómo evitar atar un flujo de trabajo a un solo modelo.
¿Cuáles son las mejores alternativas a Qwen3.8-Max?
Los rivales más obvios son Kimi K3 de Moonshot, Claude Opus 5 y GPT-5.6. Nuestra lista completa de alternativas a Qwen3.8-Max las compara en precio y disponibilidad, no solo en inteligencia declarada.

Share this article

Kurnia Kharisma Agung Samiadjie

Article by

Kurnia Kharisma Agung Samiadjie

Kurnia is a software engineer and writer at eesel AI with two years of SEO experience, writing about AI tools, helpdesk software, and customer support. He pairs a developer's understanding of how these products are built with search-driven research into what actually ranks and resonates with the people searching for them.

Related Posts

All posts →
Illustration of a person weighing a small low-cost AI model against a larger caped flagship model on pedestals
Trending

Claude Opus 5 vs Fable 5: ¿cuál deberías usar en realidad?

Fable 5 cuesta exactamente el doble que Opus 5. Repasé ambas system cards, la documentación y los benchmarks independientes para averiguar cuándo ese dólar extra realmente compra algo.

Rama Adi NugrahaRama Adi NugrahaJul 27, 2026
Ilustración que representa el precio de preview de Qwen3.8-Max de Alibaba
Trending

Precio de Qwen3.8-Max: la oferta de preview y sus costes ocultos

Una guía clara del precio de Qwen3.8-Max: la tarifa del 10% en preview, los niveles del Token Plan, el descuento nocturno y el coste de consumo de créditos que nadie pone en la página de precios.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 20, 2026
Ilustración que compara Qwen3.8-Max con modelos de IA de frontera rivales
Trending

Las 6 mejores alternativas a Qwen3.8-Max en 2026

Las mejores alternativas a Qwen3.8-Max en 2026, comparadas con honestidad: Kimi K3, Claude, GPT-5.6, Gemini 3.5 Pro, Grok 4.5 y la capa de soporte que de verdad resuelve tickets.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieJul 20, 2026
Ilustración que representa la vista previa del modelo de lenguaje Qwen3.8-Max de Alibaba
Trending

Qué es Qwen3.8-Max: la vista previa del buque insignia de Alibaba de 2,4T

Una guía en lenguaje sencillo sobre Qwen3.8-Max, la vista previa multimodal de 2,4 billones de parámetros de Alibaba: qué es, qué afirma Alibaba, cuánto cuesta y si vale la pena probarlo ahora mismo.

Alicia Kirana UtomoAlicia Kirana UtomoJul 20, 2026
Una ilustración de una persona seleccionando uno de cinco reguladores de esfuerzo de razonamiento en una barra de control al estilo Claude Opus 5
Trending

Claude Opus 5: qué es y cómo usarlo de verdad

Claude Opus 5 no es un modelo, son cinco. Una guía sencilla sobre las especificaciones, el regulador de esfuerzo que decide tu factura, y los dos cambios de API que rompen código antiguo.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieAug 5, 2026
Una ilustración de una persona seleccionando uno de los cinco diales de esfuerzo de razonamiento en una tira de control estilo Claude Opus 5
Trending

Claude Opus 5: qué es y cómo usarlo de verdad

Claude Opus 5 no es un modelo, son cinco. Una guía práctica sobre las especificaciones, el dial de esfuerzo que decide tu factura y los dos cambios de API que rompen el código antiguo.

Kurnia Kharisma Agung SamiadjieKurnia Kharisma Agung SamiadjieAug 5, 2026
Ilustración de un desarrollador accediendo a Qwen 3.8 Max de Alibaba a través del chat, lo multimodal y las superficies de API
Trending

Cómo acceder a Qwen 3.8 Max: 5 vías y qué cobra cada una

Cinco formas reales de llegar al buque insignia de 2,4 billones de parámetros de Alibaba, desde el chat gratuito hasta la API de $2/$6, además de las trampas de facturación que atrapan a la gente por el camino.

Rama Adi NugrahaRama Adi NugrahaAug 3, 2026
Ilustración que compara el Qwen 3.8 Max de Alibaba y el Kimi K3 de Moonshot AI
Trending

Qwen 3.8 Max vs Kimi K3: los números que ningún laboratorio publicó

Dos laboratorios chinos lanzaron un modelo insignia de más de 2 billones de parámetros con diecisiete días de diferencia, y ninguno incluyó al otro en su tabla de benchmarks. Esto es lo que realmente se compara, cuánto cuesta de verdad, y cuál elegiría yo.

Alicia Kirana UtomoAlicia Kirana UtomoAug 3, 2026
Illustration comparing a heavyweight reasoning model against a fast balanced model on cost and capability
Trending

Claude Opus 5 vs Sonnet 5: ¿cuál deberías usar?

Claude Opus 5 cuesta 1.7x lo que Sonnet 5 por token y aun así termina algunos trabajos más barato. Aquí va el cara a cara sobre precio, benchmarks y coste real por tarea.

Rama Adi NugrahaRama Adi NugrahaJul 27, 2026

Listo para contratar tu companero de IA?

Configuracion en minutos. Sin tarjeta de credito requerida.

Comienza gratis