Ir al contenido
IA para hoy

Tecnología

omnimodal

Relacionadas

LLM ×1OpenAI ×1multimodal ×1Google DeepMind ×1Alibaba ×1audio ×1speech synthesis ×1

Historias

Noticias

Alibaba lanza Qwen3.5-Omni, modelo multimodal que genera código desde instrucciones de voz y vídeo

Alibaba ha lanzado Qwen3.5-Omni, un modelo de IA omnimmodal que procesa texto, imágenes, audio y vídeo. El modelo supera a Gemini 3.1 Pro en tareas de audio y…

Por qué importaLa capacidad emergente de generación de código multimodal (audio-visual) sin entrenamiento específico sugiere que los modelos omnimmodales pueden…

Impacto alto Fiabilidad declaración interesada Relevancia 8/10 The Decoder