Empresas chinas escalan modelos de IA hacia varios billones de parámetros pese a liderar los pequeños
Hecho Qué ha ocurrido
Modelos chinos como Kimi K3 (2,8 billones de parámetros) y Qwen3.8-Max (2,4 billones) han escalado su tamaño total, aunque usan arquitecturas Mixture of Experts que activan solo una fracción por paso (unos 95.000 millones en Qwen3.8-Max). Alibaba confirmó el 22 de septiembre que Qwen 4 está en entrenamiento y que Qwen 4.5 y Qwen 5 podrían alcanzar entre 5 y 10 billones de parámetros; ByteDance perseguiría escalas similares según Financial Times, sin confirmación oficial.
Resumen generado mediante IA a partir de Xataka. Naturaleza de la información: análisis u opinión.
Análisis Por qué importa
Muestra que las grandes tecnológicas chinas compiten simultáneamente en eficiencia (modelos pequeños para dispositivos) y en escala masiva (modelos colosales), lo que redefine la estrategia de infraestructura y despliegue de IA en la región.
- Quién se ve afectado
- Proveedores de infraestructura cloud, empresas que evalúan modelos abiertos chinos y equipos de IT que deciden entre eficiencia y capacidad.
- Qué puede cambiar
- La disponibilidad de modelos con arquitecturas MoE de gran escala podría ampliar las opciones para tareas complejas, aunque el mayor tamaño no garantiza mejor rendimiento, como demostró Chinchilla frente a Gopher.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Vigilar el lanzamiento efectivo de Qwen 4/4.5/5 y confirmaciones de ByteDance, así como benchmarks comparativos frente a GPT-5.6 y Claude Fable 5.1, que no revelan su número de parámetros.
Enviar esta noticia por correo
Fuente original: Xataka. La referencia es siempre el artículo original.
Ver fuente original ↗LLMMixture of Expertschips AlibabaMoonshot AIByteDanceDeepSeekDeepMind ChinaKimi K3modelos grandesMoEQwen
Tu opinión
0 comentarios
Relacionadas
Google acelera el desarrollo de Gemini 4 y prevé lanzarlo antes de fin de 2026
Koray Kavukcuoglu, responsable de Google DeepMind, declaró a The Information que Gemini 4 ya está en fase de postentrenamiento y que Google busca lanzar una…
Por qué importaIndica que Google intensifica la competencia frente a OpenAI y Anthropic en modelos con capacidades agénticas y de programación, un área clave para…
El nuevo jefe de Google DeepMind adelanta que Gemini 4 llegará antes de fin de año
El nuevo responsable de Google DeepMind ha declarado que Gemini 4, el próximo modelo insignia de IA de Google, se lanzará antes de que termine 2026. Según…
Por qué importaUn lanzamiento más rápido de la próxima generación de Gemini intensifica la carrera competitiva con OpenAI y Anthropic, y puede acelerar la…
El jefe de DeepMind anticipa que Gemini 4 llegará antes de fin de 2026
Koray Kavukcuoglu, nuevo líder de DeepMind, dijo a The Information que Gemini 4 está en fase de postentrenamiento y se usa internamente en Antigravity, la…
Por qué importaGoogle necesita un salto de calidad claro para no quedar rezagado frente a los lanzamientos recientes de Claude Opus 5.5 y GPT-6 de OpenAI y…
El jefe de Google DeepMind anticipa el lanzamiento de Gemini 4 antes de fin de año
Koray Kavukcuoglu, nuevo líder de Google DeepMind, declaró a The Information que Gemini 4 está en fase de refinamiento. Afirmó que la intención de Google es…
Por qué importaGemini 4 marcaría el próximo paso de Google en la carrera de modelos de IA de frontera, tras haber quedado rezagado frente a competidores como OpenAI…



