Alibaba programa la publicación de los pesos abiertos de Qwen3.8-27B para el 14 de agosto

El equipo Qwen de Alibaba fijó el 14 de agosto para un modelo denso visión-lenguaje de 27B, pero los materiales proporcionados no confirman cuándo aparecerán los pesos descargables.

By · Published

Primary source: Qwen / Alibaba

Why it matters

The planned 27B model gives developers a much smaller Qwen3.8 target than Alibaba's 2.4T checkpoint, provided downloadable weights become available.

Alibaba schedules Qwen3.8-27B open-weight release for August 14

Alibaba's Qwen project programó Qwen3.8-27B, un checkpoint denso de visión y lenguaje, para su lanzamiento el 14 de agosto de 2026. Los desarrolladores podrían probar el modelo más pequeño localmente si los archivos descargables llegan a estar disponibles. Alibaba está dirigida por el cofundador y CEO Eddie Wu.

Los materiales revisados para este informe no establecen si ni exactamente cuándo los pesos llegaron a ser descargables.

La cuenta oficial cuenta de Qwen (@Alibaba_Qwen) dijo en una publicación de cuenta regresiva que el lanzamiento programado estaba a menos de dos horas.

Qwen / Alibaba en X

Material preliminar del repositorio recopilado para este informe describió Qwen3.8-27B como un modelo vision-language denso de 27 mil millones de parámetros con una ventana de contexto nativa de 262,144 tokens que puede extenderse a aproximadamente 1 millón de tokens. La imagen promocional de Alibaba describe a Qwen3.8-27B como una "renovación del querido modelo Qwen" que ofrece "densidad de inteligencia", una descripción de la compañía que las pruebas independientes no han establecido.

Un punto de control más pequeño para Qwen3.8

Alibaba ya ha publicado pesos para Qwen3.8-2.4T-A95B, un modelo mixture-of-experts con 2.4 billones de parámetros en total y 95 mil millones activados para cada token. Qwen3.8-27B figura como un modelo separado; Alibaba ha descrito a Qwen3.8-Max como un modelo de 2.4 billones de parámetros.

Si se libera, Qwen3.8-27B daría a la línea Qwen3.8 un checkpoint denso más pequeño junto al modelo de 2.4 billones de parámetros. Los materiales suministrados no establecen que el modelo de 27B haya sido destilado de, o derivado técnicamente de, el modelo mayor. Un checkpoint denso de 27B sigue siendo exigente computacionalmente, particularmente en contextos largos, aunque su número de parámetros hace más plausible la evaluación y el despliegue local que con el modelo 2.4T. El material suministrado no especifica una configuración de hardware ni el costo de despliegue para Qwen3.8-27B.

La descripción preliminar incluye entrada de imagen y video junto con texto, con usos previstos que abarcan codificación, investigación, trabajo profesional y tareas de agentes de larga duración. También menciona compatibilidad con Transformers, vLLM, SGLang y TokenSpeed, lo que da a los equipos varios marcos de inferencia establecidos para probar una vez que los artefactos estén disponibles.

El material de Alibaba indica que el modo de pensamiento está habilitado por defecto y puede ajustarse mediante la configuración reasoning_effort etiquetada xhigh, medium y low. Esos controles están pensados para ayudar a los operadores a equilibrar la calidad de la respuesta, la latencia y el costo de inferencia. Su costo práctico dependerá de los pesos finales, la implementación de despliegue y la cantidad de razonamiento que el modelo genere.

Pesos abiertos e inferencia administrada

Wu se incorporó a Alibaba como director de tecnología en 1999, el año en que sus 18 cofundadores establecieron el grupo. Más tarde se desempeñó como chief technology officer de Alipay y Taobao, dirigió las operaciones de búsqueda, publicidad y móvil de Alibaba, y fundó la firma de inversión enfocada en tecnología Vision Plus Capital en 2015. Eddie Wu se convirtió en chief executive officer de Alibaba Group el 10 de septiembre de 2023.

En una carta a accionistas firmada por Wu y el presidente Joe Tsai en mayo de 2024, los ejecutivos escribieron que entrenar grandes modelos de lenguaje y usarlos para desarrollo o inferencia requieren recursos de cómputo. También dijeron que abrir el código de Qwen creó "demanda adicional" por el modelo propietario de Alibaba y los recursos de cómputo relacionados. La carta no establece que Qwen3.8-27B genere uso pagado de Alibaba Cloud ni que los usuarios autoalojados compren servicios de agentes.

Alibaba distribuye los modelos Qwen a través de Hugging Face y opera Qwen Cloud, que proporciona acceso a modelos alojados y APIs. Los materiales suministrados no establecen el precio del checkpoint del 14 de agosto ni su impacto en los ingresos en la nube.

Alibaba informó en mayo de 2026 que los ingresos externos del Cloud Intelligence Group crecieron 40% interanual durante el trimestre de marzo. Alibaba no atribuyó ese crecimiento a Qwen3.8-27B.

Del acceso emblemático a las pruebas locales

Qwen3.8-27B es un desarrollo separado del artículo reciente de RuntimeWire, "El recuento de Qwen Cloud de Alibaba expone una plataforma para desarrolladores centrada en agentes", que se centró en el servicio para desarrolladores alojado de Alibaba. El anuncio del 14 de agosto concierne un checkpoint más pequeño que los desarrolladores podrían inspeccionar y ejecutar fuera de esa plataforma.

RuntimeWire informó a principios de agosto que Alibaba planeaba pesos de modelo para su buque insignia de 2.4 billones de parámetros mientras los términos de la licencia permanecían sin resolver. Una revisión posterior de su vista previa en la nube encontró que los desarrolladores aún carecían de un objetivo estable para evaluar la versión alojada.

Alibaba también publica plugins multimodales que conectan las capacidades de Qwen con entornos de agentes incluyendo Claude Code, Codex y Gemini CLI. Qwen Cloud ofrece agentes que pueden llamar a herramientas y llevar a cabo trabajos en múltiples pasos. Estas son ofertas de producto documentadas, aunque los materiales suministrados no las vinculan comercialmente con Qwen3.8-27B.

Si el checkpoint llega a ser descargable, los desarrolladores podrán inspeccionar su comportamiento, medir el uso de memoria y el rendimiento, y comparar la inferencia local con alternativas alojadas. Evaluaciones reproducibles podrían entonces probar su desempeño en codificación, visión y agentes a través de los marcos de inferencia compatibles. Versiones cuantizadas, si se publican, proporcionarían otra vía para evaluar el modelo en configuraciones de hardware más pequeñas.

Por ahora, la promoción oficial de Qwen de Alibaba fijó el 14 de agosto como la fecha de lanzamiento. Los materiales suministrados no establecen la disponibilidad descargable ni su momento exacto.

Reader comments

Conversation for this story loads after sign-in.