Tecnología
visión-lenguaje
Relacionadas
LLM ×2agentes ×1multimodal ×1edge-ai ×1Hugging Face ×1Meta ×1Liquid AI ×1decodificación especulativa ×1OCR ×1
Historias
Noticias
Liquid AI lanza LFM2.5-VL-3B, modelo multimodal eficiente para inferencia en dispositivos
Liquid AI ha anunciado LFM2.5-VL-3B, un modelo de visión-lenguaje de 3 mil millones de parámetros optimizado para ejecución en dispositivos periféricos. El…
Por qué importaRepresenta un avance en la viabilidad de modelos multimodales avanzados sin depender de infraestructura en la nube, reduciendo latencia, costes…
Meta presenta Muse Glimmer: modelo multimodal abierto de 30B parámetros con soporte inmediato
Meta ha lanzado Muse Glimmer, un modelo de visión-lenguaje denso de 30 mil millones de parámetros, bajo licencia abierta. El modelo incluye un codificador de…
Por qué importaEs el modelo multimodal más accesible en escala media con capacidades de agencia y herramientas nativas, permitiendo despliegue local sin depender de…
