AllSpark lanza Iris-mini e Iris-pro, agentes de búsqueda de código abierto basados en Qwen

Hecho Qué ha ocurrido
El laboratorio chino AllSpark ha publicado Iris-mini (35B parámetros) e Iris-pro (397B), dos agentes de búsqueda basados en modelos Qwen, junto con su receta de entrenamiento y benchmarks. Según el paper, ambos modelos lideran los resultados entre agentes de búsqueda de pesos abiertos en su categoría de tamaño, evaluados en BrowseComp, BrowseComp-ZH, DeepSearchQA y Humanity's Last Exam. Los pesos están disponibles en Hugging Face y el código en GitHub.
Resumen generado mediante IA a partir de The Decoder (original en inglés). Naturaleza de la información: declaración de parte interesada.
Análisis Por qué importa
Ofrece a empresas y desarrolladores una alternativa abierta y auditable a agentes de búsqueda propietarios, con metodología transparente de entrenamiento y evaluación rigurosa que expone las limitaciones de benchmarks actuales.
- Quién se ve afectado
- Equipos de IT y desarrollo que construyen agentes de búsqueda, investigadores de IA y empresas que evalúan alternativas open-weight a soluciones cerradas.
- Qué puede cambiar
- Se facilita la adopción de agentes de búsqueda avanzados sin depender de proveedores cerrados, y se generaliza la práctica de separar el efecto de la gestión de contexto del rendimiento real del modelo al evaluar benchmarks.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Si el equipo cumple su promesa de liberar el pipeline completo de datos y entrenamiento, y si otros laboratorios adoptan su metodología de evaluación con y sin gestión de contexto para comparar de forma más justa.
Recomendación Qué debería hacer una empresa
Equipos técnicos que evalúen agentes de búsqueda open-source deberían probar Iris-mini o Iris-pro en los próximos 3-6 meses como alternativa a soluciones propietarias, revisando su comportamiento en tareas propias antes de integrarlos en producción.
Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.
Enviar esta noticia por correo
Fuente original: The Decoder. La referencia es siempre el artículo original.
Ver fuente original ↗agentesLLMRAG AllSparkAlibaba agentes de búsquedaAllSparkIRISopen sourceQwen
Tu opinión
0 comentarios
Relacionadas
OpenAI entrenó GPT-6 Astra con 100.000 GPUs y Nvidia prevé 400.000 para el próximo modelo
OpenAI entrenó GPT-6 Astra usando 100.000 GPUs en el centro de datos Stargate (Abilene, Texas), con un costo estimado entre 500 millones y 1.000 millones de…
Por qué importaEl salto de escala en cómputo (de 100.000 a 400.000 GPUs) muestra que la carrera de infraestructura de IA sigue acelerándose con costos e…
GPT-6 Astra supera a Claude Fable en benchmarks de agentes económicos y control de drones
Andon Labs evaluó GPT-6 Astra de OpenAI en dos benchmarks: Vending-Bench, donde gestiona un negocio simulado, y Drone-Bench, donde controla un dron DJI Tello…
Por qué importaEstos resultados muestran avances concretos en la capacidad de los modelos de IA para operar de forma autónoma en tareas económicas y físicas…
GPT-6 Astra lidera benchmark de matemáticas pese a no ser prioridad de OpenAI
OpenAI's GPT-6 Astra obtuvo el primer puesto en ErdosBench, un benchmark de 226 problemas matemáticos abiertos inspirados en los problemas de Erdős, con una…
Por qué importaMuestra que incluso el laboratorio líder en IA enfrenta compromisos de optimización: mejorar en un dominio implica sacrificar avances en otros…
OpenAI lanza GPT-6 Astra, su modelo más avanzado para uso empresarial
OpenAI ha presentado GPT-6 Astra, descrito como su modelo más capaz orientado al trabajo. El anuncio destaca mejoras en razonamiento avanzado, uso de ordenador…
Por qué importaUn salto de capacidad en el modelo insignia de OpenAI redefine el estándar de referencia para agentes y asistentes empresariales, afectando a toda la…



