El equipo Qwen de Alibaba adelantó Qwen3.8 Max el 19 de julio, un buque insignia de 2,4 billones de parámetros anunciado con la World AI Conference de Shanghai como telón de fondo. El momento elegido no fue sutil. Llegó dos días después de que Moonshot lanzara Kimi K3, un modelo de pesos abiertos de 2,8 billones de parámetros, y se lee como una respuesta directa en una escalada que ahora se mide en días y no en trimestres.

Qwen3.8 Max es el primer modelo del equipo por encima del billón de parámetros que es nativamente multimodal, procesando texto, imágenes, vídeo y documentos en un solo sistema. Alibaba afirma que supera al anterior Qwen3.7 Max en programación, desarrollo full stack, análisis de datos y flujos de trabajo de oficina, y posiciona la versión preliminar como su modelo más potente hasta la fecha en la mayoría de las tareas prácticas.

El lanzamiento viene con salvedades reales, declaradas por la propia compañía. Todavía no hay model card, ni tabla de benchmarks, ni licencia. Las afirmaciones de rendimiento son de la propia Alibaba, incluida la asercion de que, entre los sistemas que evaluó, Qwen3.8 Max solo queda por detrás de un modelo propietario de frontera. La versión preliminar está genuinamente disponible, comprable a través de la suscripción Token Plan de Alibaba al 10 por ciento del precio estándar mientras la build se estabiliza, y el equipo dice que la última versión preliminar volvió a mejorar en trabajo de frontend web. Los pesos abiertos están prometidos para pronto, sin fecha.

El contexto es una oleada de modelos abiertos chinos que ha definido julio. Kimi K3 llegó como el mayor modelo abierto jamás publicado y de inmediato tenso su propia capacidad de servicio. DeepSeek V4 Pro y GLM 5.2 publicaron ambos grandes lanzamientos abiertos a comienzos de este verano. Qwen ha sido el editor de pesos abiertos más prolífico de todos los laboratorios, y una entrada de 2,4 billones de parámetros, si los pesos realmente llegan, sería con diferencia la mayor de las suyas.

La señal tiene menos que ver con un benchmark concreto y más con la cadencia. Los sistemas multimodales de un billón de parámetros ahora reciben respuesta de sus rivales en 48 horas, las versiones preliminares se publican antes que la documentación, y la frontera de lo que puede comprarse públicamente se mueve cada semana. Los benchmarks independientes, la model card y los pesos prometidos son lo que hay que vigilar. Hasta que lleguen, Qwen3.8 Max es una afirmación muy grande con una demo en vivo.