Ir al contenido
IA para hoy
Modelos y avances Lanzamiento 3/5 · Una fuente fiable

Alibaba lanza Qwen3.8-Flash-Next, modelo multimodal MoE abierto con arquitectura de Qwen4

Alibaba lanza Qwen3.8-Flash-Next, modelo multimodal MoE abierto con arquitectura de Qwen4
Foto: Schäferle · Licencia Pixabay · Pixabay

Hecho Qué ha ocurrido

Alibaba ha publicado Qwen3.8-Flash-Next, un modelo de pesos abiertos multimodal basado en mezcla de expertos (MoE) con 125 mil millones de parámetros pero solo 6 mil millones activos, lo que proporciona un impulso significativo de rendimiento. El modelo sirve como avance preliminar de la arquitectura que se utilizará en Qwen4. Simon Willison lo ha probado en hardware DGX Spark con versiones cuantizadas de Unsloth de entre 72,5 GB y 78,9 GB.

Resumen generado mediante IA a partir de Simon Willison (original en inglés). Naturaleza de la información: hecho documentado.

Análisis Por qué importa

La publicación de un modelo abierto de gran escala que anticipa la arquitectura de Qwen4 permite a desarrolladores y empresas acceder a capacidades multimodales avanzadas sin depender de proveedores cerrados, mientras reduce significativamente los costes de inferencia mediante arquitectura MoE eficiente. Este enfoque competitivo de Alibaba refuerza el ecosistema de modelos abiertos frente a alternativas propietarias.

Quién se ve afectado
Desarrolladores e investigadores, empresas que necesitan modelos multimodales de código abierto, operadores de infraestructura que buscan optimizar costes de inferencia.
Qué puede cambiar
La disponibilidad de un modelo abierto de 125B parámetros con activación parcial reduce la barrera de entrada para ejecutar capacidades multimodal complejas en hardware estándar, permitiendo experimentación y despliegue independiente sin restricciones de acceso de proveedores propietarios.

Análisis generado a partir de la información disponible; no procede de la fuente.

Ilustración generada con IA sobre: Alibaba lanza Qwen3.8-Flash-Next, modelo multimodal MoE abierto con arquitectura de Qwen4
Ilustración generada con IA por IA para hoy

Predicción Qué observar a continuación

Adopción del modelo en entornos de producción y comparativas de rendimiento respecto a alternativas propietarias; evolución de la arquitectura anunciada en Qwen4; disponibilidad y rendimiento de versiones cuantizadas optimizadas; velocidad de adopción en ecosistema de código abierto.

Recomendación Qué debería hacer una empresa

Evaluar en los próximos 3-6 meses si Qwen3.8-Flash-Next ofrece relación rendimiento-coste competitiva respecto a modelos multimodales propietarios en casos de uso específicos de su organización, particularmente para procesamiento de imágenes y razonamiento visual.

Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.

Compartir WhatsApp LinkedIn X Bluesky Telegram
Enviar esta noticia por correo

Se envía esta noticia con su análisis. La dirección se usa solo para ese envío y no se guarda.

Fuente original: Simon Willison. La referencia es siempre el artículo original.

Ver fuente original ↗

LLMmultimodalMoEcuantizacion AlibabaNvidia Alibabaeficiencia-inferenciamodelo abiertomultimodalQwen

Tu opinión

0 comentarios

Sin registro. La primera vez te pediremos confirmar el correo y el comentario pasará por moderación; después se publican al momento si cumplen las normas. Se guarda un resumen de tu IP para evitar abusos.

Relacionadas

Modelos y avances

Mistral lanza en preview Large 4, modelo de un billón de parámetros entrenado en GPUs propias

Mistral presentó una preview de Mistral Large 4, un modelo de 1 billón de parámetros totales y 49.000 millones activos, entrenado en un clúster propio de 3.800…

Por qué importaMistral recupera competitividad frente a la frontera tecnológica tras un modelo anterior claramente rezagado, lo que mantiene viva una alternativa…

Impacto medio Fiabilidad confirmado por varias fuentes Relevancia 7/10 Simon Willison
Modelos y avances

Mistral lanza Large 4, su modelo insignia más potente y se posiciona como alternativa europea abierta

Mistral presentó Large 4 (ML4), un modelo Mixture-of-Experts con 1,05 billones de parámetros totales y 49.000 millones activos, multimodal y entrenado con…

Por qué importaEs el intento más ambicioso de Mistral por acercarse a la frontera de los modelos abiertos y ofrece a empresas europeas una alternativa con…

Impacto medio Fiabilidad confirmado por varias fuentes Relevancia 7/10 Xataka
Modelos y avances

Mistral presenta Mistral Large 4, modelo de un billón de parámetros

Mistral ha presentado Mistral Large 4, descrito como su modelo más grande y potente hasta la fecha, con un billón de parámetros. La compañía destaca su…

Por qué importaEs la apuesta más ambiciosa de Mistral por competir con los grandes modelos de OpenAI, Google o Anthropic en capacidades empresariales avanzadas como…

Impacto medio Fiabilidad confirmado por varias fuentes Relevancia 7/10 Europa Press Portaltic
Modelos y avances

Mistral lanza Large 4 'Le Chonk', modelo abierto de un billón de parámetros

La francesa Mistral ha lanzado en preview Mistral Large 4, apodado 'Le Chonk', un modelo de un billón de parámetros de pesos abiertos, con versión final…

Por qué importaSupone una alternativa europea de pesos abiertos frente a la dependencia de modelos cerrados estadounidenses, en un contexto de restricciones de EEUU…

Impacto alto Fiabilidad confirmado por varias fuentes Relevancia 8/10 Wired AI