Ir al contenido
IA para hoy

El WEF señala un giro hacia el criterio experto humano como nuevo activo escaso para entrenar IA

El WEF señala un giro hacia el criterio experto humano como nuevo activo escaso para entrenar IA
Foto: Alexey M. · CC BY-SA 4.0 · Wikidata

Hecho Qué ha ocurrido

El World Economic Forum publicó el 15 de septiembre un análisis que señala que el feedback y el criterio de profesionales expertos se están convirtiendo en un insumo clave para entrenar modelos de IA especializados, más allá del volumen de datos. Cita el caso de Thinking Machines Lab y Bridgewater Associates, donde un modelo ajustado con feedback de inversores expertos superó a otros con menor coste. También menciona startups como Micro1 (de 7 a 150 millones de dólares de ingresos anualizados entre 2025 y 2026) y Mercor, que contratan médicos, abogados y banqueros para evaluar respuestas de modelos y construyeron el benchmark APEX, en el que GPT-5 obtuvo un 64,2% frente al 35,9% de GPT-4o.

Resumen generado mediante IA a partir de Business Insider España. Naturaleza de la información: análisis u opinión.

Análisis Por qué importa

Indica un cambio en la economía de los datos de IA: la ventaja competitiva podría desplazarse hacia el conocimiento acumulado de cómo los profesionales de una organización resuelven casos complejos, un activo difícil de copiar o comprar.

Quién se ve afectado
Empresas de IA que entrenan modelos especializados, profesionales con conocimiento experto (médicos, abogados, financieros) y organizaciones con grandes volúmenes de decisiones documentadas.
Qué puede cambiar
Las empresas podrían empezar a valorar y monetizar el feedback experto interno como un activo estratégico, y surgir más startups intermediarias que conecten expertos con desarrolladores de IA.

Análisis generado a partir de la información disponible; no procede de la fuente.

Predicción Qué observar a continuación

Conviene seguir la evolución de ingresos y valoraciones de startups como Micro1 y Mercor, la aparición de nuevos benchmarks basados en criterio profesional, y si las grandes tecnológicas empiezan a formalizar acuerdos similares al de Thinking Machines Lab con Bridgewater.

Recomendación Qué debería hacer una empresa

Las empresas con datos históricos de decisiones expertas (bancos, hospitales, bufetes) deberían evaluar en los próximos 12 meses cómo estructurar y proteger ese conocimiento como activo diferencial frente a modelos de IA genéricos.

Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.

Compartir WhatsApp LinkedIn X Bluesky Telegram
Enviar esta noticia por correo

Se envía esta noticia con su análisis. La dirección se usa solo para ese envío y no se guarda.

Fuente original: Business Insider España. La referencia es siempre el artículo original.

Ver fuente original ↗

LLMRAGagentesbenchmark World Economic ForumThinking Machines LabBridgewater AssociatesMicro1Mercor criterio expertodatos de entrenamientoMercorMicro1WEF

Tu opinión

0 comentarios

Sin registro. La primera vez te pediremos confirmar el correo y el comentario pasará por moderación; después se publican al momento si cumplen las normas. Se guarda un resumen de tu IP para evitar abusos.

Relacionadas

Empresa y transformación digital

Empleado de seguridad de OpenAI dimite y denuncia una 'cultura rota' en la empresa

David Robinson, quien lideró informes de seguridad en lanzamientos clave de OpenAI y uno de los empleados con más antigüedad (3,5 años), renunció a la…

Por qué importaEs la segunda salida pública reciente de un empleado de seguridad que cuestiona las prácticas internas de los grandes laboratorios de IA, reforzando…

Impacto medio Fiabilidad confirmado por varias fuentes Relevancia 7/10 TechCrunch AI
Empresa y transformación digital

Responsable de informes de seguridad de OpenAI renuncia y denuncia cultura de 'confianza extrema' en la IA

David Robinson, quien lideraba la redacción de informes de seguridad en el equipo Trustworthy AI de OpenAI, renunció y publicó un ensayo crítico en The…

Por qué importaSon renuncias de perfiles técnicos internos con acceso directo a los procesos de seguridad, lo que da mayor peso a las advertencias sobre la falta de…

Impacto medio Fiabilidad confirmado por varias fuentes Relevancia 7/10 Infobae Tecno
Empresa y transformación digital

Meta Muse llega a 5 millones de descargas en 22 días, récord frente a ChatGPT, Grok y Claude

Meta Muse alcanzó 5 millones de descargas en 22 días, según Sensor Tower, más rápido que ChatGPT (56 días), Grok (103) y Claude (492). The Information reporta…

Por qué importaMeta demuestra que la distribución propia puede superar a la innovación técnica como ventaja competitiva en la carrera de agentes de IA, y el bloqueo…

Impacto alto Fiabilidad confirmado por varias fuentes Relevancia 7/10 WWWhat's new

El mercado de suites de productividad con IA se fragmenta entre Microsoft, Google, OpenAI, Anthropic y Notion

OpenAI ha lanzado ChatGPT Work y ChatGPT Space, Anthropic ha estrenado Claude Docs y Claude Slides, Google ha convertido a Gemini en orquestador de Workspace y…

Por qué importaLa elección de suite ya no es binaria entre Microsoft y Google: ahora compite el contexto de datos, la integración de agentes y el modelo de precios…

Impacto medio Fiabilidad una fuente fiable Xataka