Ir al contenido
IA para hoy

Tecnología

visión-lenguaje

Relacionadas

LLM ×2agentes ×1multimodal ×1edge-ai ×1Hugging Face ×1Meta ×1Liquid AI ×1decodificación especulativa ×1OCR ×1

Historias

Noticias

Liquid AI lanza LFM2.5-VL-3B, modelo multimodal eficiente para inferencia en dispositivos

Liquid AI ha anunciado LFM2.5-VL-3B, un modelo de visión-lenguaje de 3 mil millones de parámetros optimizado para ejecución en dispositivos periféricos. El…

Por qué importaRepresenta un avance en la viabilidad de modelos multimodales avanzados sin depender de infraestructura en la nube, reduciendo latencia, costes…

Impacto alto Fiabilidad fuente primaria Hugging Face
Herramientas y productos 4 fuentes

Meta presenta Muse Glimmer: modelo multimodal abierto de 30B parámetros con soporte inmediato

Meta ha lanzado Muse Glimmer, un modelo de visión-lenguaje denso de 30 mil millones de parámetros, bajo licencia abierta. El modelo incluye un codificador de…

Por qué importaEs el modelo multimodal más accesible en escala media con capacidades de agencia y herramientas nativas, permitiendo despliegue local sin depender de…

Impacto alto Fiabilidad confirmado por varias fuentes Hugging Face