Ir al contenido
IA para hoy

Lo esencial del día

Google abarata Gemini Flash mientras GLM 5.2 presiona los precios de los modelos frontera

21 de julio de 2026, 14:00

La jornada gira en torno al coste por token: Google lanza una familia Gemini Flash más eficiente y el laboratorio chino Z.ai ofrece un modelo abierto competitivo por una quinta parte del precio de Anthropic. En paralelo, los agentes ganan terreno real en producción —Anthropic dice que Claude Tag firma el 65% de sus pull requests— y crecen las voces que piden formas de medir si hacen lo que se les pide.

Gemini 3.6 Flash: 17% menos tokens de salida y precio a la baja

Fotografía de archivo que ilustra: Google DeepMind lanza Gemini 3.6 Flash y 3.5 Flash-Lite con mayor eficiencia de tokens
Foto: Lisa Fotios · Licencia Pexels · Pexels

Google DeepMind presenta Gemini 3.6 Flash, 3.5 Flash-Lite y una variante Flash Cyber para ciberseguridad reservada a gobiernos y partners. La mejora en eficiencia de tokens y la bajada de precios facilitan escalar agentes en producción con menor gasto.

GLM 5.2 se acerca a los modelos frontera a una fracción del coste

Fotografía de archivo que ilustra: GLM 5.2 de Z.ai compite con modelos frontera occidentales a fracción de coste
Foto: Zayed Hossain · Licencia Pexels · Pexels

Z.ai lanzó GLM 5.2, modelo abierto con licencia MIT y 753.000 millones de parámetros, a 4,40 dólares por millón de tokens de salida. Iguala o se aproxima a Opus 4.8 en varios benchmarks de codificación agentica, lo que obliga a los equipos a revisar sus presupuestos de tokens.

Claude Tag genera el 65% de los PR internos de Anthropic

Ilustración generada con IA sobre: Claude Tag de Anthropic alcanza el 65% de PRs en ingeniería de producto interno
Ilustración generada con IA por IA para hoy

La integración de Claude en Slack, con memoria de equipo y automatización continua, ya produce dos tercios de los pull requests del equipo de ingeniería de producto de Anthropic. Es una señal de que los agentes colaborativos pueden competir con los flujos tradicionales de revisión de código.

Una métrica para saber si el agente hace lo que le pides

Ilustración generada con IA sobre: IEEE Spectrum propone el "Genie Coefficient" para medir fidelidad de agentes IA
Ilustración generada con IA por IA para hoy

IEEE Spectrum propone el "Genie Coefficient", que mide la distancia entre la petición del usuario y lo que el agente realmente ejecuta. Con agentes conectados a APIs, navegadores y bases de datos, disponer de una medida comparable es clave antes de delegarles tareas críticas.

OpenAI se dirige a la pequeña empresa

Ilustración generada con IA sobre: OpenAI lanza programa ChatGPT para pequeñas empresas
Ilustración generada con IA por IA para hoy

OpenAI lanza un programa de ChatGPT para pymes y emprendedores, centrado en formación en IA y automatización de tareas con ChatGPT Work. Confirma su interés por un segmento con poco acceso histórico a herramientas de IA empresarial.

OpenAI y Hugging Face detallan un incidente de seguridad

Fotografía de archivo que ilustra: OpenAI y Hugging Face comparten hallazgos sobre incidente de seguridad en evaluación de modelos
Foto: Tima Miroshnichenko · Licencia Pexels · Pexels

Ambas compañías publican hallazgos preliminares sobre un incidente ocurrido durante la evaluación de modelos, que puso de manifiesto capacidades cibernéticas avanzadas. La divulgación aporta lecciones prácticas para reforzar defensas en entornos de evaluación.

Conviene vigilar cómo la competencia en precio de los modelos abiertos afecta a los contratos con proveedores occidentales, y si la gobernanza de los agentes avanza al mismo ritmo que su despliegue.

Días anteriores

Ver todo el archivo de resúmenes