El WEF señala un giro hacia el criterio experto humano como nuevo activo escaso para entrenar IA

Hecho Qué ha ocurrido
El World Economic Forum publicó el 15 de septiembre un análisis que señala que el feedback y el criterio de profesionales expertos se están convirtiendo en un insumo clave para entrenar modelos de IA especializados, más allá del volumen de datos. Cita el caso de Thinking Machines Lab y Bridgewater Associates, donde un modelo ajustado con feedback de inversores expertos superó a otros con menor coste. También menciona startups como Micro1 (de 7 a 150 millones de dólares de ingresos anualizados entre 2025 y 2026) y Mercor, que contratan médicos, abogados y banqueros para evaluar respuestas de modelos y construyeron el benchmark APEX, en el que GPT-5 obtuvo un 64,2% frente al 35,9% de GPT-4o.
Resumen generado mediante IA a partir de Business Insider España. Naturaleza de la información: análisis u opinión.
Análisis Por qué importa
Indica un cambio en la economía de los datos de IA: la ventaja competitiva podría desplazarse hacia el conocimiento acumulado de cómo los profesionales de una organización resuelven casos complejos, un activo difícil de copiar o comprar.
- Quién se ve afectado
- Empresas de IA que entrenan modelos especializados, profesionales con conocimiento experto (médicos, abogados, financieros) y organizaciones con grandes volúmenes de decisiones documentadas.
- Qué puede cambiar
- Las empresas podrían empezar a valorar y monetizar el feedback experto interno como un activo estratégico, y surgir más startups intermediarias que conecten expertos con desarrolladores de IA.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Conviene seguir la evolución de ingresos y valoraciones de startups como Micro1 y Mercor, la aparición de nuevos benchmarks basados en criterio profesional, y si las grandes tecnológicas empiezan a formalizar acuerdos similares al de Thinking Machines Lab con Bridgewater.
Recomendación Qué debería hacer una empresa
Las empresas con datos históricos de decisiones expertas (bancos, hospitales, bufetes) deberían evaluar en los próximos 12 meses cómo estructurar y proteger ese conocimiento como activo diferencial frente a modelos de IA genéricos.
Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.
Enviar esta noticia por correo
Fuente original: Business Insider España. La referencia es siempre el artículo original.
Ver fuente original ↗LLMRAGagentesbenchmark World Economic ForumThinking Machines LabBridgewater AssociatesMicro1Mercor criterio expertodatos de entrenamientoMercorMicro1WEF
Tu opinión
0 comentarios
Relacionadas
Empleado de seguridad de OpenAI dimite y denuncia una 'cultura rota' en la empresa
David Robinson, quien lideró informes de seguridad en lanzamientos clave de OpenAI y uno de los empleados con más antigüedad (3,5 años), renunció a la…
Por qué importaEs la segunda salida pública reciente de un empleado de seguridad que cuestiona las prácticas internas de los grandes laboratorios de IA, reforzando…
Responsable de informes de seguridad de OpenAI renuncia y denuncia cultura de 'confianza extrema' en la IA
David Robinson, quien lideraba la redacción de informes de seguridad en el equipo Trustworthy AI de OpenAI, renunció y publicó un ensayo crítico en The…
Por qué importaSon renuncias de perfiles técnicos internos con acceso directo a los procesos de seguridad, lo que da mayor peso a las advertencias sobre la falta de…
Meta Muse llega a 5 millones de descargas en 22 días, récord frente a ChatGPT, Grok y Claude
Meta Muse alcanzó 5 millones de descargas en 22 días, según Sensor Tower, más rápido que ChatGPT (56 días), Grok (103) y Claude (492). The Information reporta…
Por qué importaMeta demuestra que la distribución propia puede superar a la innovación técnica como ventaja competitiva en la carrera de agentes de IA, y el bloqueo…
El mercado de suites de productividad con IA se fragmenta entre Microsoft, Google, OpenAI, Anthropic y Notion
OpenAI ha lanzado ChatGPT Work y ChatGPT Space, Anthropic ha estrenado Claude Docs y Claude Slides, Google ha convertido a Gemini en orquestador de Workspace y…
Por qué importaLa elección de suite ya no es binaria entre Microsoft y Google: ahora compite el contexto de datos, la integración de agentes y el modelo de precios…



