Alibaba lanza Qwen3.8-Max, con los pesos abiertos programados para la próxima semana

El modelo de 2.4 billones de parámetros está disponible en QwenCloud a $2 por millón de tokens de entrada, mientras que los pesos descargables aún están pendientes.

By · Published

Primary source: Qwen

Why it matters

Alibaba is pairing a frontier hosted API with promised open weights, using developer distribution to drive cloud demand and challenge closed US coding models.

Illustration of Qwen3.8-Max shown as a monumental, streamlined abstract structure symbolizing Alibaba's ultra-large AI and its availability on QwenCloud.

Alibaba lanzó Qwen3.8-Max el 2 de agosto, dando a los desarrolladores acceso inmediato a través de QwenCloud y prometiendo publicar los pesos del modelo la semana siguiente. El lanzamiento marca el primer plan de Alibaba para abrir un modelo Qwen de clase Max, extendiendo su estrategia de publicar pesos al nivel más exigente computacionalmente de la familia. (qwen.ai)

Qwen3.8-Max es un modelo mixture-of-experts con 2.4 billones de parámetros en total y 95 mil millones de parámetros activos, según Qwen. Alibaba lo está posicionando para codificación, investigación, trabajo profesional y tareas que se extienden por varios días, en lugar de sesiones cortas de preguntas y respuestas.

El trabajo del modelo se ubica dentro de Alibaba Cloud bajo el director de tecnología Jingren Zhou, quien lidera el desarrollo de Qwen y de los modelos de video Wan de Alibaba. Zhou trabajó anteriormente en sistemas de bases de datos y big data en Microsoft y tiene un doctorado en informática por Columbia University. Su mandato conecta el desarrollo del modelo Qwen directamente con la infraestructura en la nube que Alibaba quiere que los desarrolladores paguen por usar. (columbia.edu)

Hospedado primero, pesos después

Qwen3.8-Max ya está disponible a través de QwenCloud, incluyendo una API compatible con OpenAI. QwenCloud indica una ventana de contexto de 1 millón de tokens, una salida máxima de aproximadamente 131,000 tokens y soporte para entradas de texto, imagen y video. El precio listado es de $2 por millón de tokens de entrada y $6 por millón de tokens de salida, con tarifas más bajas para entradas en caché. (docs.qwencloud.com)

Esa secuencia le da a Alibaba una ventaja en el uso en la nube antes de que los desarrolladores puedan descargar y ejecutar el modelo en otro lugar. El endpoint hospedado también proporciona la ruta más sencilla para equipos que no cuentan con la infraestructura necesaria para servir un modelo con 95 mil millones de parámetros activos.

Alibaba no ha asociado una valoración ni una ronda de capital de riesgo a Qwen porque la familia de modelos se financia dentro del grupo. En febrero de 2025, Alibaba comprometió al menos RMB380 mil millones, entonces aproximadamente $53 mil millones, a infraestructura de nube e IA durante tres años. El director ejecutivo Eddie Wu, cofundador de Alibaba y su primer director de tecnología, ha convertido la computación en la nube en el centro comercial de ese plan de gastos. (alibabagroup.com)

La economía ya es visible en los informes de Alibaba. En marzo, Alibaba dijo que los ingresos del Cloud Intelligence Group para el trimestre de diciembre aumentaron 36% interanual a RMB43.3 mil millones, mientras que los ingresos por productos relacionados con IA registraron un crecimiento de tres dígitos por décimo trimestre consecutivo. Esas son cifras reportadas por la compañía, y Alibaba no separa los ingresos del modelo Qwen de sus resultados más amplios de la nube. (home.alibabagroup.com)

Qwen convierte la codificación autónoma en el caso de lanzamiento

En una demostración, Qwen dice que el modelo pasó alrededor de 16 días construyendo y manteniendo un proyecto de agente de código autónomo llamado oh-my-cli. Los requisitos se ingresaron mediante issues de GitHub, los agentes reclamaron el trabajo y los cambios avanzaron a través de pruebas y verificaciones de pull request.

El anuncio original contabilizó 265 commits, 127 pull requests y 151 issues al 30 de julio. Para el 3 de agosto, el repositorio público mostraba 424 commits. Su código y reglas de operación pueden ser inspeccionados, incluyendo un "contrato de autonomía" que describe cómo los reportes de usuarios, los hallazgos de la comunidad y los descubrimientos reproducibles del modelo se convierten en issues normalizados para su ejecución. El repositorio usa Node.js y TypeScript y tiene licencia Apache 2.0. (github.com)

Qwen también dice que el modelo reprodujo los experimentos de un reciente artículo de investigación sobre selección de datos y luego intentó mejorar el método publicado. Según la publicación de lanzamiento, la ejecución duró alrededor de 125 horas, generó aproximadamente 7,600 líneas de código, realizó más de 1,100 acciones y completó 33 ejecuciones de entrenamiento en GPU sin ayuda humana.

Esas demostraciones son evidencia más sólida que un benchmark estático de codificación porque dejan código e historial del proyecto. Aún así, se originan en Qwen, y el caso de lanzamiento depende en gran medida de las propias evaluaciones de Alibaba y de trazas de proyecto seleccionadas. Las comparaciones de rendimiento en el anuncio deben leerse como resultados de la compañía hasta que evaluadores externos prueben el modelo hospedado y, más tarde, los pesos descargables.

Comparación de rendimiento publicada por la compañía Qwen para Qwen3.8-Max

El compromiso de publicar los pesos es la bisagra estratégica. Alibaba ha usado modelos Qwen descargables para ganar distribución fuera de sus propios productos, mientras que QwenCloud convierte una porción de esa atención de desarrolladores en inferencias pagadas. Alibaba dijo en marzo que la familia Qwen había superado los 1,000 millones de descargas acumuladas en Hugging Face al 21 de enero. (home.alibabagroup.com)

Qwen3.8-Max lleva esa estrategia al nivel emblemático de Alibaba. La API es el producto disponible hoy. Los pesos prometidos determinarán hasta qué punto los desarrolladores pueden inspeccionar, modificar y desplegar independientemente el modelo, y si Alibaba ha entregado una alternativa abierta en el mismo nivel que vende a través de su nube.

Reader comments

Conversation for this story loads after sign-in.