Alibaba lanza Qwen3.8-Flash-Next, modelo multimodal MoE abierto con arquitectura de Qwen4

Hecho Qué ha ocurrido
Alibaba ha publicado Qwen3.8-Flash-Next, un modelo de pesos abiertos multimodal basado en mezcla de expertos (MoE) con 125 mil millones de parámetros pero solo 6 mil millones activos, lo que proporciona un impulso significativo de rendimiento. El modelo sirve como avance preliminar de la arquitectura que se utilizará en Qwen4. Simon Willison lo ha probado en hardware DGX Spark con versiones cuantizadas de Unsloth de entre 72,5 GB y 78,9 GB.
Resumen generado mediante IA a partir de Simon Willison (original en inglés). Naturaleza de la información: hecho documentado.
Análisis Por qué importa
La publicación de un modelo abierto de gran escala que anticipa la arquitectura de Qwen4 permite a desarrolladores y empresas acceder a capacidades multimodales avanzadas sin depender de proveedores cerrados, mientras reduce significativamente los costes de inferencia mediante arquitectura MoE eficiente. Este enfoque competitivo de Alibaba refuerza el ecosistema de modelos abiertos frente a alternativas propietarias.
- Quién se ve afectado
- Desarrolladores e investigadores, empresas que necesitan modelos multimodales de código abierto, operadores de infraestructura que buscan optimizar costes de inferencia.
- Qué puede cambiar
- La disponibilidad de un modelo abierto de 125B parámetros con activación parcial reduce la barrera de entrada para ejecutar capacidades multimodal complejas en hardware estándar, permitiendo experimentación y despliegue independiente sin restricciones de acceso de proveedores propietarios.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Adopción del modelo en entornos de producción y comparativas de rendimiento respecto a alternativas propietarias; evolución de la arquitectura anunciada en Qwen4; disponibilidad y rendimiento de versiones cuantizadas optimizadas; velocidad de adopción en ecosistema de código abierto.
Recomendación Qué debería hacer una empresa
Evaluar en los próximos 3-6 meses si Qwen3.8-Flash-Next ofrece relación rendimiento-coste competitiva respecto a modelos multimodales propietarios en casos de uso específicos de su organización, particularmente para procesamiento de imágenes y razonamiento visual.
Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.
Enviar esta noticia por correo
Fuente original: Simon Willison. La referencia es siempre el artículo original.
Ver fuente original ↗LLMmultimodalMoEcuantizacion AlibabaNvidia Alibabaeficiencia-inferenciamodelo abiertomultimodalQwen
Tu opinión
0 comentarios
Relacionadas
Mistral lanza en preview Large 4, modelo de un billón de parámetros entrenado en GPUs propias
Mistral presentó una preview de Mistral Large 4, un modelo de 1 billón de parámetros totales y 49.000 millones activos, entrenado en un clúster propio de 3.800…
Por qué importaMistral recupera competitividad frente a la frontera tecnológica tras un modelo anterior claramente rezagado, lo que mantiene viva una alternativa…
Mistral lanza Large 4, su modelo insignia más potente y se posiciona como alternativa europea abierta
Mistral presentó Large 4 (ML4), un modelo Mixture-of-Experts con 1,05 billones de parámetros totales y 49.000 millones activos, multimodal y entrenado con…
Por qué importaEs el intento más ambicioso de Mistral por acercarse a la frontera de los modelos abiertos y ofrece a empresas europeas una alternativa con…
Mistral presenta Mistral Large 4, modelo de un billón de parámetros
Mistral ha presentado Mistral Large 4, descrito como su modelo más grande y potente hasta la fecha, con un billón de parámetros. La compañía destaca su…
Por qué importaEs la apuesta más ambiciosa de Mistral por competir con los grandes modelos de OpenAI, Google o Anthropic en capacidades empresariales avanzadas como…
Mistral lanza Large 4 'Le Chonk', modelo abierto de un billón de parámetros
La francesa Mistral ha lanzado en preview Mistral Large 4, apodado 'Le Chonk', un modelo de un billón de parámetros de pesos abiertos, con versión final…
Por qué importaSupone una alternativa europea de pesos abiertos frente a la dependencia de modelos cerrados estadounidenses, en un contexto de restricciones de EEUU…


