OpenAI lanza GPT-5.4 mini y nano con precios muy competitivos

Hecho Qué ha ocurrido
OpenAI ha presentado dos nuevos modelos de la serie GPT-5.4: mini y nano, que se suman al modelo GPT-5.4 lanzado hace dos semanas. Según los benchmarks publicados por OpenAI, el GPT-5.4 nano supera al anterior GPT-5 mini incluso con máximo esfuerzo de razonamiento, y el nuevo mini es 2x más rápido que su predecesor. El modelo nano cuesta $0,20 por millón de tokens de entrada, siendo más barato que Google Gemini 3.1 Flash-Lite ($0,25); un análisis práctico muestra que procesar 76.000 fotos costaría alrededor de $52,44.
Resumen generado mediante IA a partir de Simon Willison (original en inglés). Naturaleza de la información: hecho documentado.
Análisis Por qué importa
La disponibilidad de modelos más pequeños y baratos amplía el acceso a IA generativa de calidad para empresas con presupuestos limitados y casos de uso a escala masiva. La caída drástica de costos por token redefinirá la viabilidad económica de proyectos de visión por computadora, procesamiento en lote y aplicaciones de bajo margen.
- Quién se ve afectado
- Empresas que realizan análisis masivo de imágenes o textos, startups con presupuestos ajustados, equipos de análisis de datos, desarrolladores independientes y plataformas que ofrecen servicios basados en IA generativa.
- Qué puede cambiar
- Tareas que antes eran económicamente inviables (procesar millones de documentos o imágenes) pasan a ser rutinarias y predecibles en costo. La competencia por precio en modelos pequeños se intensifica, presionando a rivales como Google y Anthropic a ajustar sus estrategias de precios y rendimiento.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Adopción de GPT-5.4 nano en aplicaciones de escala masiva; respuesta de competidores (Google Gemini, Claude, Amazon Nova) en precios o capacidades; si nano mantiene calidad en tareas reales más allá de los benchmarks; velocidad de cambio en favor de OpenAI en el segmento de modelos económicos.
Recomendación Qué debería hacer una empresa
Evaluar dentro de 2-4 semanas si GPT-5.4 nano resuelve casos de uso en tu empresa (análisis de imágenes, documentos, tabulación de datos) que antes eran demasiado costosos; comparar experimentalmente contra Gemini 3.1 Flash-Lite y Claude Haiku en tus cargas reales.
Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.
Enviar esta noticia por correo
Fuente original: Simon Willison. La referencia es siempre el artículo original.
Ver fuente original ↗LLMvisión por computadora OpenAIGoogleAnthropic benchmarksGPT-5.4modelos pequeñosOpenAIprecios
Tu opinión
0 comentarios
Relacionadas
Apple lanza Apple Reference Image, autenticación criptográfica de fotos en el iPhone 18 Pro
Apple ha introducido Apple Reference Image, una función del iPhone 18 Pro que firma criptográficamente los datos del sensor de la cámara en el momento de la…
Por qué importaEs la primera implementación comercial de autenticación de imágenes a nivel de hardware, lo que podría presionar a toda la industria a adoptar…
IBM y Red Hat lanzan Lightwell para acelerar la corrección de vulnerabilidades open source con IA
Según CETaS del Alan Turing Institute, más del 45% de las vulnerabilidades en grandes organizaciones tardan casi un año en corregirse. IBM y Red Hat…
Por qué importaLa IA acelera la detección de vulnerabilidades pero no la remediación, generando una brecha de riesgo que las empresas deben gestionar como prioridad…
Apple presenta 'Reference Image' en iPhone 18 Pro para verificar fotos frente a imágenes generadas por IA
Apple anunció la función Apple Reference Image para el iPhone 18 Pro y Pro Max, que captura datos firmados del sensor y usa Private Cloud Compute para generar…
Por qué importaEs un intento de una gran fabricante de establecer un estándar de autenticidad fotográfica verificable por hardware, relevante en un contexto de…
DeepSeek lanza V4.1-Flash: reduce memoria caché para agentes de IA más baratos
DeepSeek publicó V4.1-Flash, un modelo multimodal de 552.000 millones de parámetros que reduce la memoria caché KV a una cuarta parte respecto a su predecesor…
Por qué importaLa reducción drástica de memoria caché abarata significativamente el despliegue de agentes de IA que operan en contextos largos y con múltiples…



