Laboratorio de IA · en inglés
Hugging Face
Historial de fiabilidad
La fiabilidad de cada noticia se calcula con reglas fijas: tipo y peso de la fuente, naturaleza de la información (hecho documentado, declaración interesada, análisis o rumor) y número de fuentes independientes que la confirman. Un laboratorio o institución hablando de lo suyo puntúa como fuente primaria; un rumor sin confirmar, como el nivel más bajo.
Últimas noticias de esta fuente
H Company lanza NeoMME, encoder multimodal eficiente para recuperación de documentos visuales
H Company presenta NeoMME, familia de encoders multimodales y multilingües de 260M y 800M parámetros entrenados desde cero con un objetivo de difusión discreta…
Por qué importaOfrece una alternativa más eficiente en coste y velocidad a los modelos de recuperación basados en VLMs generativos, relevante para empresas que…
Hugging Face reproduce con TRL y OpenEnv un modelo de código que pinta acuarelas mediante RL
Un ingeniero de Hugging Face reproduce en abierto un proyecto viral de Surya Narreddi que entrena un modelo de lenguaje para escribir JavaScript (usando…
Por qué importaIlustra cómo el RL con jueces de preferencia (no solo recompensas verificables) puede aplicarse a tareas creativas y subjetivas como el 'gusto…
Hugging Face lanza funes, capa de memoria persistente para agentes de codificación
Hugging Face publicó funes, una herramienta open source que indexa las sesiones locales de agentes de codificación (Claude Code, Codex, pi, Hermes) para crear…
Por qué importaResuelve el problema de que los agentes de codificación pierden el contexto y razonamiento de sesiones previas, lo que obliga a repetir trabajo o…
Hugging Face muestra cómo GRPO mejora salidas estructuradas en un modelo de 350M parámetros
Un tutorial de Hugging Face aplica fine-tuning con GRPO y LoRA sobre LFM2.5-350M usando ~500 muestras y 100 pasos de entrenamiento, dirigido a mejorar el…
Por qué importaDemuestra que el fine-tuning con RL de bajo coste puede mejorar sustancialmente la fiabilidad de salidas estructuradas en modelos pequeños…
IBM y Confluent integran modelos de series temporales en streaming en tiempo real
IBM Research ha presentado cuatro modelos fundacionales de series temporales (PatchTST-FM, FlowState, TTM y TSPulse) integrados con la plataforma de streaming…
Por qué importaTraslada la toma de decisiones operacionales de ciclos de meses a segundos, eliminando la necesidad de equipos de ciencia de datos dedicados y…
BenchMIRT: método para auditar qué miden realmente los benchmarks de modelos
Allen Institute for AI ha presentado BenchMIRT, una metodología que aplica teoría de respuesta a items multidimensional (MIRT) para analizar benchmarks de…
Por qué importaPara equipos de investigación y empresas que evalúan modelos, comprender qué mide realmente cada benchmark es crítico para elegir las herramientas de…
Hugging Face lanza 207 kernels WebGPU optimizados para IA en navegador
Hugging Face ha publicado @huggingface/kernels, una biblioteca con 207 kernels WebGPU optimizados para ejecutar modelos de IA localmente en el navegador. Cada…
Por qué importaLa inferencia local en navegador reduce latencia, coste de servidor y dependencia de APIs externas, haciendo viable desplegar IA en aplicaciones web…
Hugging Face añade Hindi e inglés indio al Open ASR Leaderboard con 4.888 hablantes
Hugging Face ha introducido dos nuevos conjuntos de evaluación en el Open ASR Leaderboard: Monsoon en-IN (inglés indio) y Monsoon hi-IN (hindi), convirtiéndose…
Por qué importaLos benchmarks públicos de reconocimiento de voz (ASR) tienden a ocultar sesgos demográficos mediante métricas agregadas; investigación previa…
Hugging Face publica guía para entrenar modelos multi-vector con Sentence Transformers
Hugging Face ha publicado una guía técnica sobre cómo entrenar y ajustar modelos de incrustación multi-vector (late-interaction) usando Sentence Transformers…
Por qué importaDemocratiza el entrenamiento de modelos especializados de recuperación sin infraestructura costosa, permitiendo que equipos internos adapten búsqueda…
IBM Granite 4.2: modelos de razonamiento con capacidad de agentes y contexto de 512K
IBM ha lanzado Granite 4.2, una familia de modelos de lenguaje densos enfocados en razonamiento, disponibles en tres tamaños: 3B, 8B y 30B. Los modelos se…
Por qué importaGranite 4.2 representa un hito en modelos abiertos de razonamiento y capacidad de agentes autónomos, con contexto extremadamente largo y…
Multiverse Computing presenta técnica para modelos IA 4-bit más precisos que versiones completas
Multiverse Computing ha publicado un paper sobre Quantization-Aware Healing (QAH), una técnica de recuperación de modelos comprimidos y cuantizados a 4 bits…
Por qué importaEste resultado invierte la relación tradicional entre modelos cuantizados de baja precisión e hipótesis de pérdida de precisión, lo que tiene…
Gradio lanza gr.Workflow: interfaz visual para crear pipelines de IA sin código
Hugging Face ha anunciado gr.Workflow, una característica integrada en Gradio que permite construir pipelines de inteligencia artificial mediante un lienzo de…
Por qué importaReduce significativamente la barrera técnica para crear y desplegar aplicaciones complejas de IA, permitiendo que equipos de producto y no-expertos…











