Alibaba presentó el 19 de julio de 2026, en la Conferencia Mundial de
Inteligencia Artificial de Shanghái, un modelo con una afirmación de
las más atrevidas del año: Qwen 3.8, dicen, "solo queda por detrás de
Fable 5" — el modelo insignia de Anthropic. Si se confirma, lo situaría
entre los sistemas de IA más capaces del planeta.
La cifra que impresiona: 2,4 billones de parámetros
Qwen 3.8 usa una arquitectura sparse Mixture-of-Experts con 2,4 billones de parámetros totales, convirtiéndose en el primer modelo Qwen por encima del billón de parámetros en ser además multimodal — puede procesar imágenes, vídeo y documentos, no solo texto.
Llega apenas días después de Kimi K3, de Moonshot AI (en la que Alibaba
tiene una participación del 36%), que se adelantó con 2,8 billones de
parámetros — el segundo modelo de pesos abiertos más grande divulgado
públicamente hasta ahora.
El matiz que hay que tener clarísimo antes de creerse el titular
Aquí está lo más importante de todo este lanzamiento: la afirmación
de "solo por detrás de Fable 5" viene exclusivamente de Alibaba, sin
ningún benchmark independiente, ficha técnica pública, ni prueba de
terceros que la respalde. No hay resultados verificables en Hugging
Face ni en ningún tablero de evaluación independiente a fecha de este
artículo. Para cualquiera que evalúe adoptarlo con criterio, esto
significa que la decisión debe basarse en pruebas propias, no en la
cifra de marketing del propio fabricante.
Como referencia de la generación anterior: Qwen 3.7-Max obtuvo 92,4%
en GPQA Diamond, 80,4% en SWE-bench Verified y 69,7% en Terminal-Bench
2.0 — cifras reales y verificadas de la versión previa, que dan una
idea de dónde parte la familia Qwen, aunque no confirmen nada sobre
la 3.8.
Pesos abiertos, pero sin fecha ni licencia todavía
Alibaba ha prometido pesos abiertos "próximamente", sin comprometer
fecha, licencia ni enlace de descarga concretos. De momento, el modelo
solo está disponible en preview (Qwen3.8-Max-Preview) a través del
Token Plan de Alibaba y sus plataformas de programación Qoder y
QoderWork, con descuento del 90% sobre el precio estándar durante esta
fase.
Enfoque práctico: código y trabajo de oficina, no solo benchmarks abstractos
Según el propio equipo de Qwen, el modelo debería superar a Qwen
3.7-Max especialmente en programación y tareas de productividad
complejas: desarrollo full-stack, análisis de datos, flujos de trabajo
de oficina. El modo de razonamiento está siempre activo, con tres
niveles de intensidad seleccionables (bajo, alto, extra-alto) según
cuánto "piense" el modelo antes de responder.
El patrón que de verdad importa, más allá de esta cifra concreta
Lo relevante no es tanto si Qwen 3.8 iguala o no a los modelos frontera
estadounidenses — es que ni Qwen 3.8, ni Kimi K3, ni GLM-5.2
necesitan ser literalmente los mejores del mundo para cambiar las
reglas del juego. Para empresas y desarrolladores, tener acceso a un
modelo que rinde casi al nivel de los mejores, cuesta bastante menos,
y puede instalarse en infraestructura propia por tener pesos abiertos,
resulta cada vez más atractivo frente a pagar el precio de los modelos
cerrados más punteros. Cada lanzamiento de este tipo presiona a la
baja los precios en todo el sector.
Qué hacer con esta información ahora mismo
Si evalúas modelos para tu propio uso (código, automatización, análisis),
la recomendación honesta es esperar a benchmarks independientes o
probarlo tú mismo en la preview antes de tomar cualquier decisión
basada en el titular de "segundo mejor del mundo" — que, de momento,
es solo la palabra de quien lo vende.



