Ir al contenido
IA para hoy
Investigación Investigación 2/5 · Declaración interesada

Nvidia presenta SoL-Pi, un sistema que reduce casi a la mitad el uso de tokens en agentes de codificación

Nvidia presenta SoL-Pi, un sistema que reduce casi a la mitad el uso de tokens en agentes de codificación
Foto: cookieone · Licencia Pixabay · Pixabay

Hecho Qué ha ocurrido

Investigadores de Nvidia desarrollaron SoL-Pi, un sistema que optimiza automáticamente el 'harness' (capa de control) entre modelos y agentes de codificación. Tras probar 152 enfoques en más de 3.000 ejecuciones sobre 535 entornos, la variante más eficiente reduce el uso de tokens en un 49% manteniendo el 93,7% del rendimiento del harness original Pi. Los autores estiman ahorros de entre 4,36 y 13,50 dólares por hora según la comparación, y los resultados se mantuvieron parcialmente al aplicarse a otro modelo (Opus 5) sin reentrenamiento.

Resumen generado mediante IA a partir de The Decoder (original en inglés). Naturaleza de la información: hecho documentado.

Análisis Por qué importa

Muestra que optimizar la capa de orquestación de agentes puede reducir costes casi tanto como cambiar de modelo, abriendo una vía de ahorro complementaria a la reducción de precios de los LLM.

Quién se ve afectado
Equipos de desarrollo de software, empresas que operan agentes de codificación a escala y proveedores de infraestructura de IA agéntica.
Qué puede cambiar
Las empresas podrían empezar a optimizar el harness de sus agentes, no solo el modelo subyacente, como palanca de reducción de costes operativos en IA agéntica.

Análisis generado a partir de la información disponible; no procede de la fuente.

Predicción Qué observar a continuación

Vigilar si Nvidia u otros liberan estas técnicas de forma reutilizable, si se replican en benchmarks más variados, y si aparece 'pretraining' de harnesses como sugieren los autores.

Recomendación Qué debería hacer una empresa

Equipos que operan agentes de codificación en producción deberían evaluar en los próximos 6-12 meses técnicas de compactación de contexto y fusión de acciones similares para reducir costes de tokens.

Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.

Compartir WhatsApp LinkedIn X Bluesky Telegram
Enviar esta noticia por correo

Se envía esta noticia con su análisis. La dirección se usa solo para ese envío y no se guarda.

Fuente original: The Decoder. La referencia es siempre el artículo original.

Ver fuente original ↗

agentesLLMcoding NvidiaOpenAIAnthropicComposio agentes de IAcodingNvidiaoptimización de costesSoL-Pi

Tu opinión

0 comentarios

Sin registro. La primera vez te pediremos confirmar el correo y el comentario pasará por moderación; después se publican al momento si cumplen las normas. Se guarda un resumen de tu IP para evitar abusos.

Relacionadas

Investigación

Modelos de OpenAI y Anthropic descifran dos mensajes Enigma nazis sin resolver desde hace décadas

El desarrollador Carter Leffen usó el modelo Astra de OpenAI para descifrar un mensaje Enigma de 1941 (MVUEH) sin resolver desde 2005, probando 14,8 millones…

Por qué importaMuestra la capacidad de los modelos más avanzados para realizar tareas de investigación autónoma, construcción de simuladores y búsqueda combinatoria…

Impacto bajo Fiabilidad declaración interesada Relevancia 7/10 Infobae Tecno
Investigación

Matemáticos debaten el papel de la IA tras la solución de OpenAI a Navier-Stokes

OpenAI propuso una solución al problema de Navier-Stokes, uno de los grandes retos matemáticos, lo que generó debate en la comunidad matemática internacional…

Por qué importaEl caso ilustra la tensión entre la lógica comercial de las grandes tecnológicas y los procesos de validación, colaboración y rigor propios de la…

Impacto bajo Fiabilidad declaración interesada Business Insider España
Investigación

Investigadores presentan SpaCEy, red neuronal de grafos explicable para vincular patrones tisulares con supervivencia en cáncer

Un equipo del Institute for Computational Biomedicine de la Universidad de Heidelberg presentó SpaCEy, una red neuronal de grafos explicable que modela tejidos…

Por qué importaEs un avance en investigación biomédica que muestra cómo la IA explicable puede extraer biomarcadores espaciales relevantes sin depender de…

Impacto bajo Fiabilidad fuente primaria Nature · Machine learning
Investigación

Google prepara primer lanzamiento de satélite con chips TPU del Proyecto Suncatcher

Google lanzará, con ayuda de SpaceX, un satélite prototipo del Proyecto Suncatcher para probar si sus chips TPU pueden operar en órbita. La misión viajará en…

Por qué importaSi el hardware de IA puede funcionar en el espacio, se abriría una vía alternativa para procesar cargas de IA aprovechando energía solar casi…

Impacto bajo Fiabilidad varias fuentes Infobae Tecno