Ir al contenido
IA para hoy

Modelos y avances

Nuevos modelos, capacidades, benchmarks y avances técnicos

38 noticias · RSS de esta sección

Filtrar
Modelos y avances 5 fuentes

GPT-6 Astra completa Portal de principio a fin sin ayuda humana en 24 horas

El desarrollador cozyblaze publicó en X y GitHub un experimento en el que GPT-6 Astra jugó y completó el videojuego Portal de forma autónoma tras recibir un…

Por qué importaDemuestra capacidades de planificación y ejecución autónoma a largo plazo en entornos interactivos complejos, un paso hacia agentes generales capaces…

Impacto bajo Fiabilidad confirmado por varias fuentes The Decoder
Modelos y avances 5 fuentes

OpenAI lanza GPT-6 Astra con récord de benchmarks, salvaguardas de ciberseguridad y disculpa por rollout caótico

OpenAI lanzó el 3 de septiembre GPT-6 Astra, el primer modelo que cruza el umbral 'Critical' de ciberseguridad en su Preparedness Framework, con ExploitBench…

Por qué importaEs el primer modelo de frontera que documenta explícitamente capacidades ofensivas críticas junto a limitaciones de supervisión, lo que tensiona el…

Impacto muy alto Fiabilidad confirmado por varias fuentes Relevancia 9/10 WWWhat's new

Artificial Analysis actualiza su Intelligence Index tras críticas por la puntuación de GPT-6 Astra

Artificial Analysis lanzó la versión 4.2 de su Intelligence Index tras críticas de que sus benchmarks no reflejaban el progreso real de GPT-6 Astra. Con la…

Por qué importaLos índices de benchmarking influyen en decisiones de compra y adopción de modelos por parte de empresas, por lo que su fiabilidad y metodología son…

Impacto bajo Fiabilidad declaración interesada The Decoder
Modelos y avances 2 fuentes

OpenAI lanza GPT-6 Astra con capacidades críticas de riesgo, entre dudas sobre benchmarks reales

OpenAI presentó GPT-6 Astra, modelo clasificado en nivel de riesgo 'Crítico' por su capacidad de desarrollar exploits cibernéticos autónomamente, según su…

Por qué importaLa brecha entre las cifras que difunde OpenAI y las verificadas de forma independiente exige cautela al evaluar anuncios de capacidades…

Impacto alto Fiabilidad varias fuentes Relevancia 8/10 ABC Tecnología

OpenAI lanza GPT-6 Astra con mayor autonomía, razonamiento y riesgo crítico en ciberseguridad

OpenAI ha presentado oficialmente GPT-6 Astra, su nuevo modelo insignia con mayor autonomía para usar ordenadores, navegar, programar e investigar de principio…

Por qué importaUn modelo capaz de completar tareas profesionales completas con alta autonomía cambia el umbral de lo que se puede delegar a la IA en entornos…

Impacto muy alto Fiabilidad declaración interesada Relevancia 9/10 MuyComputer
Modelos y avances 8 fuentes

OpenAI lanza GPT-6 Astra en medio de dudas sobre si ha logrado superinteligencia

OpenAI ha lanzado GPT-6 Astra, descrito como su modelo más potente hasta la fecha. La empresa, que prepara su salida a Bolsa, sugiere haber alcanzado…

Por qué importaUn nuevo modelo de referencia de OpenAI redefine el estado del arte y presiona a competidores y empresas a evaluar su adopción, mientras la narrativa…

Impacto alto Fiabilidad confirmado por varias fuentes Relevancia 9/10 El País Tecnología
Modelos y avances 3 fuentes

OpenAI lanza GPT-6 Astra, primer modelo que supera el umbral crítico de ciberseguridad

OpenAI ha lanzado GPT-6 Astra, que según su Marco de Preparación supera el umbral 'crítico' de riesgo de ciberseguridad, lo que conlleva restricciones…

Por qué importaEs el primer modelo comercial etiquetado con capacidad ofensiva crítica, lo que obliga a empresas y reguladores a repensar controles de acceso…

Impacto alto Fiabilidad varias fuentes Relevancia 9/10 Computerworld España
Modelos y avances 8 fuentes

OpenAI lanza GPT-6 Astra y afirma que podría marcar el inicio de la era AGI

OpenAI anunció el lanzamiento de GPT-6 Astra, que según la compañía es el mejor modelo del mundo para navegar por ordenadores y navegadores web, escribir…

Por qué importaUn modelo capaz de operar interfaces y software como un humano acelera la automatización de tareas administrativas y de oficina, con implicaciones…

Impacto muy alto Fiabilidad confirmado por varias fuentes Relevancia 9/10 Wired AI
Modelos y avances 8 fuentes

OpenAI lanza GPT-6 Astra, su nuevo modelo más avanzado

OpenAI ha anunciado GPT-6 Astra, descrito como su modelo más inteligente y alineado hasta la fecha. La compañía afirma que ofrece capacidades de última…

Por qué importaUn nuevo modelo insignia de OpenAI redefine el estado del arte y presiona a competidores y empresas a evaluar su adopción, especialmente por las…

Impacto alto Fiabilidad confirmado por varias fuentes Relevancia 9/10 OpenAI
Modelos y avances 8 fuentes

OpenAI dice que Astra alcanza el nivel 'crítico' de riesgo cibernético según su marco de preparación

OpenAI ha anunciado que Astra es el primer modelo de la compañía en cumplir el umbral 'Critical' de capacidad en ciberseguridad según su Preparedness…

Por qué importaUn modelo con capacidades críticas en ciberseguridad puede usarse tanto para defensa avanzada como para ataques sofisticados, lo que eleva el riesgo…

Impacto alto Fiabilidad confirmado por varias fuentes Relevancia 8/10 OpenAI
Modelos y avances 3 fuentes

OpenAI pausa entrenamientos de modelos avanzados tras detectar capacidades ofensivas críticas

OpenAI detuvo el entrenamiento de sus modelos más avanzados, incluyendo Astra, después de detectar señales preocupantes en su capacidad ofensiva de…

Por qué importaLa pausa en el entrenamiento de modelos de nivel próximo a GPT-6 revela tensiones crecientes entre capacidad y seguridad en IA de frontera; refleja…

Impacto alto Fiabilidad varias fuentes Relevancia 8/10 Hipertextual
Modelos y avances 2 fuentes

Grok 4.6 alcanza el nivel de GPT-5.6 Sol con ventaja de precio competitivo

xAI ha lanzado Grok 4.6, que alcanza 61 puntos en el Intelligence Index de Artificial Analysis, igualando a GPT-5.6 Sol y aproximándose a Claude Fable 5 y…

Por qué importaGrok rompe el duopolio de OpenAI y Anthropic en modelos frontera y ofrece una alternativa económica sin sacrificar capacidad, lo que puede forzar una…

Impacto alto Fiabilidad una fuente fiable Relevancia 8/10 Xataka

Startups desarrollan alternativas a transformers para mejorar eficiencia de LLMs

Un conjunto de startups está desarrollando nuevas arquitecturas de redes neuronales para superar las limitaciones de los transformers, la tecnología base de…

Por qué importaLas limitaciones actuales de los transformers—alto costo computacional, ventanas de contexto limitadas, ineficiencia energética—representan un cuello…

Impacto alto Fiabilidad una fuente fiable Relevancia 8/10 MIT Technology Review

OpenAI publica enfoque integrado para IA más capaz, asequible y útil

OpenAI ha publicado un documento titulado "Building abundant intelligence" que describe un enfoque de pila completa para hacer la IA avanzada más capaz, más…

Por qué importaUna estrategia de pila completa que busca democratizar y escalar la IA avanzada puede influir en cómo las empresas acceden y adoptan tecnología de…

Impacto medio Fiabilidad una fuente fiable OpenAI
Modelos y avances 3 fuentes

OpenAI mejora GPT-5.6 en benchmark ARC-AGI-3 con dos configuraciones de API

OpenAI ha publicado que ajustes en dos configuraciones de su API han triplicado el rendimiento de GPT-5.6 en el benchmark ARC-AGI-3. Los cambios implican…

Por qué importaLas mejoras en benchmarks de razonamiento como ARC-AGI-3 indican progreso en capacidades fundamentales de resolución de problemas. Para empresas…

Impacto medio Fiabilidad una fuente fiable Relevancia 7/10 OpenAI

Google DeepMind lanza Gemini 3.6 Flash y 3.5 Flash-Lite con mayor eficiencia de tokens

Google DeepMind ha presentado tres nuevos modelos Gemini: 3.6 Flash, 3.5 Flash-Lite y 3.5 Flash Cyber. Gemini 3.6 Flash consume 17% menos tokens de salida que…

Por qué importaLa eficiencia de tokens y reducción de costos permiten escalar agentes IA en producción con menor gasto, mientras que Flash-Lite abre oportunidades…

Impacto alto Fiabilidad fuente primaria Relevancia 8/10 Google DeepMind
Modelos y avances 2 fuentes

Moonshot AI lanza Kimi K3, modelo abierto que preocupa a Wall Street por competencia china

Moonshot AI, empresa china, lanzó Kimi K3, una versión de código abierto de su modelo de IA que demuestra desempeño competitivo con modelos frontera como…

Por qué importaLa liberación de modelos abiertos de calidad frontera por empresas chinas plantea dilemas estratégicos sobre soberanía tecnológica, regulación y…

Impacto alto Fiabilidad varias fuentes Relevancia 7/10 TechCrunch AI

Moonshot lanza Kimi K3, modelo abierto de 2,8 billones de parámetros competitivo con Claude y GPT-5.5

Moonshot ha lanzado Kimi K3, un modelo de inteligencia artificial abierto con 2,8 billones de parámetros y ventana de contexto de 1 millón de tokens. Según…

Por qué importaKimi K3 representa un avance competitivo importante del ecosistema de IA chino, demostrando capacidad para rivalizar con modelos occidentales líderes…

Impacto alto Fiabilidad declaración interesada Relevancia 7/10 Hipertextual

Moonshot AI prepara Kimi K3, modelo abierto chino de 2-3 billones de parámetros

Moonshot AI, laboratorio chino, prepara el lanzamiento de Kimi K3, un modelo de IA abierto con entre 2 y 3 billones de parámetros, según reportó Financial…

Por qué importaRefleja la aceleración de modelos abiertos chinos de alto rendimiento como alternativa viable a laboratorios cerrados costosos (OpenAI, Anthropic)…

Impacto alto Fiabilidad una fuente fiable Relevancia 7/10 TechCrunch AI
Modelos y avances 2 fuentes

Thinking Machines lanza Inkling: modelo abierto multimodal de 975B parámetros con contexto de 1M

Thinking Machines ha lanzado Inkling, un modelo de lenguaje abierto con 975B parámetros totales (41B activos) que procesa de forma nativa imagen, texto y…

Por qué importaInkling representa un avance significativo en modelos multimodales abiertos de gran escala, demostrando que la capacidad nativa de razonamiento entre…

Impacto alto Fiabilidad confirmado por varias fuentes Relevancia 8/10 Hugging Face

OpenAI presenta GPT-5.6, modelo con mayor eficiencia de costes y rendimiento por token

OpenAI ha lanzado GPT-5.6, una nueva versión de su modelo de lenguaje con énfasis en mayor inteligencia por cada token procesado, mejor rendimiento económico y…

Por qué importaLa mejora en eficiencia de costes es crítica para empresas que dependen de APIs de IA: reduce el gasto operativo de aplicaciones en producción y…

Impacto alto Fiabilidad una fuente fiable Relevancia 8/10 OpenAI
Modelos y avances 2 fuentes

Gemini con Deep Think logra nivel de medalla de oro en la Olimpiada Internacional de Matemáticas

Google DeepMind anunció que una versión avanzada de Gemini con Deep Think resolvió 5 de 6 problemas de la Olimpiada Internacional de Matemáticas (IMO) 2025…

Por qué importaEste hito demuestra que los modelos de IA han alcanzado razonamiento matemático de nivel élite, comparable al de los mejores matemáticos humanos del…

Impacto alto Fiabilidad confirmado por varias fuentes Relevancia 9/10 Google DeepMind

Google DeepMind resume los avances de 2023: Bard, PaLM 2, Gemini y mejoras en código

Google DeepMind publica un resumen de 2023 destacando el lanzamiento de Bard (febrero), PaLM 2 (mayo), Gemini (diciembre) en tres tamaños (Nano, Pro, Ultra) y…

Por qué importaDocumenta los hitos técnicos más relevantes de Google DeepMind en un año de consolidación de IA generativa, con métricas verificables sobre desempeño…

Impacto alto Fiabilidad fuente primaria Relevancia 7/10 Google DeepMind