Alibaba lanza Qwen3.5-Omni, modelo multimodal que genera código desde instrucciones de voz y vídeo
Alibaba ha lanzado Qwen3.5-Omni, un modelo de IA omnimmodal que procesa texto, imágenes, audio y vídeo. El modelo supera a Gemini 3.1 Pro en tareas de audio y…
Por qué importaLa capacidad emergente de generación de código multimodal (audio-visual) sin entrenamiento específico sugiere que los modelos omnimmodales pueden…
Impacto alto
Fiabilidad declaración interesada
Relevancia 8/10
The Decoder